| HN Mirror

Y	Hacker News new \| ask \| show \| jobs


	by robert-zaremba 259 days ago
	KAT-Dev-32B and KAT-Coder are optimized via several stages of training, including a mid-training stage, supervised fine-tuning (SFT) & reinforcement fine-tuning (RFT) stage and an large-scale agentic reinforcement learning (RL) stage.