
		<rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom">
			<channel>
				<title>José David Baena – Software Engineer</title>
				<link>https://josedavidbaena.com</link>
				<description>Personal website and blog where I document thoughts, ideas, and interests in software engineering, web performance, and open source technologies.</description>
				<language>en-us</language>
				<managingEditor>josedab@gmail.com (José David Baena)</managingEditor>
				<webMaster>josedab@gmail.com (José David Baena)</webMaster>
				<lastBuildDate>Sat, 01 Aug 2026 00:00:00 GMT</lastBuildDate>
				<atom:link href="https://josedavidbaena.com/tags/kimi-k3/feed.xml" rel="self" type="application/rss+xml"/>
				
		<item>
			<guid>https://josedavidbaena.com/blog/kimi-k3/06-lab-experiment-roadmap</guid>
			<title>Kimi K3 Ideas Need Experiments Before Design Rules</title>
			<link>https://josedavidbaena.com/blog/kimi-k3/06-lab-experiment-roadmap</link>
			<description>Turn Kimi K3 mechanisms into draft experiments with fixed controls, repetitions, uncertainty reporting, and explicit limits on every conclusion.</description>
			<pubDate>Sat, 01 Aug 2026 00:00:00 GMT</pubDate>
			<author>josedab@gmail.com (José David Baena)</author>
			<category>kimi-k3</category><category>experiments</category><category>ablation</category><category>reproducibility</category><category>model-architecture</category>
		</item>
	
		<item>
			<guid>https://josedavidbaena.com/blog/kimi-k3/05-api-vs-self-hosting-cost</guid>
			<title>Kimi K3 Cost Model: Hosted API Versus Self-Hosting</title>
			<link>https://josedavidbaena.com/blog/kimi-k3/05-api-vs-self-hosting-cost</link>
			<description>Model Kimi K3 API and self-hosting costs with real token mixes, topology quotes, measured throughput, redundancy, storage, and engineering overhead.</description>
			<pubDate>Fri, 31 Jul 2026 00:00:00 GMT</pubDate>
			<author>josedab@gmail.com (José David Baena)</author>
			<category>kimi-k3</category><category>api-pricing</category><category>self-hosting</category><category>cost-optimization</category><category>inference</category>
		</item>
	
		<item>
			<guid>https://josedavidbaena.com/blog/kimi-k3/04-checkpoint-parameter-accounting</guid>
			<title>How 2.8T Parameters Fit in a 1.56 TB Kimi K3 Checkpoint</title>
			<link>https://josedavidbaena.com/blog/kimi-k3/04-checkpoint-parameter-accounting</link>
			<description>Reconstruct how Kimi K3&#39;s 1.561 TB snapshot combines packed FP4 values, scales, BF16/F32 tensors, shard overhead, and repository files.</description>
			<pubDate>Thu, 30 Jul 2026 00:00:00 GMT</pubDate>
			<author>josedab@gmail.com (José David Baena)</author>
			<category>kimi-k3</category><category>quantization</category><category>mxfp4</category><category>model-weights</category><category>checkpoint</category>
		</item>
	
		<item>
			<guid>https://josedavidbaena.com/blog/kimi-k3/03-api-production-state-tools-caching</guid>
			<title>Kimi K3 API State: Tools, Caching, and Failure Modes</title>
			<link>https://josedavidbaena.com/blog/kimi-k3/03-api-production-state-tools-caching</link>
			<description>Kimi K3 is conversation-stateless at the API boundary; preserve full assistant messages, tool results, cache identity, and terminal-state checks.</description>
			<pubDate>Wed, 29 Jul 2026 00:00:00 GMT</pubDate>
			<author>josedab@gmail.com (José David Baena)</author>
			<category>kimi-k3</category><category>api</category><category>tool-calling</category><category>context-caching</category><category>production</category>
		</item>
	
		<item>
			<guid>https://josedavidbaena.com/blog/kimi-k3/02-architecture-kda-attnres-experts</guid>
			<title>Inside Kimi K3: How KDA, AttnRes, and 896 Experts Work</title>
			<link>https://josedavidbaena.com/blog/kimi-k3/02-architecture-kda-attnres-experts</link>
			<description>Trace Kimi K3&#39;s 69 KDA layers, 24 gated MLA layers, Attention Residuals, and 896 experts without overstating what released artifacts prove.</description>
			<pubDate>Tue, 28 Jul 2026 00:00:00 GMT</pubDate>
			<author>josedab@gmail.com (José David Baena)</author>
			<category>kimi-k3</category><category>architecture</category><category>attention</category><category>mixture-of-experts</category><category>machine-learning</category>
		</item>
	
		<item>
			<guid>https://josedavidbaena.com/blog/kimi-k3/01-hardware-requirements</guid>
			<title>Kimi K3 Hardware Requirements: Why 8 H100s Are Not Enough</title>
			<link>https://josedavidbaena.com/blog/kimi-k3/01-hardware-requirements</link>
			<description>Kimi K3 activates about 104.2B parameters per token, but its 1.561 TB snapshot still needs a multi-GPU memory, cache, storage, and network plan.</description>
			<pubDate>Mon, 27 Jul 2026 00:00:00 GMT</pubDate>
			<author>josedab@gmail.com (José David Baena)</author>
			<category>kimi-k3</category><category>gpu</category><category>inference</category><category>mixture-of-experts</category><category>hardware</category>
		</item>
	
			</channel>
		</rss>
	