Sep 02, 2026/13 mins readDistilled Engineering·Part 5/8LLM Compression Decision Matrix: Let the Bottleneck Pick the Technique
Aug 26, 2026/15 mins readDistilled Engineering·Part 4/8Model Distillation Breaks in the Same Ten Places Every Time
Jul 30, 2026/15 mins readKimi K3·Engineering Guide·Part 4/6How 2.8T Parameters Fit in a 1.56 TB Kimi K3 Checkpoint
Sep 27, 2025/15 mins readTiny Language Models·Training & Optimization·Part 7/10Quantization-Aware Training: INT8/INT4 Models That Maintain Quality
Sep 15, 2025/26 mins readTiny Language Models·Foundations & Architecture·Part 3/10Model Compression: 14GB to 450MB While Keeping 90% Quality
Sep 10, 2025/12 mins readTiny Language Models·Foundations & Architecture·Part 2/10Mathematical Foundations of Model Compression: Theory Behind Tiny LLMs