Hugging Face BlogArticle
Fine-tuning a 350M Model for Better Structured Outputs in 100 GRPO Steps
A practical recipe for getting structured outputs from small models. The bar for entry dropped, but this is iterative optimization, not a capability shift. Worth reading if you're already fine-tuning open-weight models; skip if you're using Claude or GPT.