Thinking Machines' Inkling: Murati's Apache-2.0 MoE for Fine-Tuning
Mira Murati's Thinking Machines Lab shipped its first model: Inkling, an Apache-2.0 Mixture-of-Experts built deliberately as a fine-tuning base, not a frontier competitor. Here is the MoE fine-tuning strategy, quantization reality, and the fine-tune vs RAG vs prompt decision framework.