arXivJingtan Wang, Arun Verma, Xiaoqiang Lin, Zhengyuan Liu, Nancy F. Chen, Daniela Rus, Bryan Kian Hsiang LowTue, Sep 1, 2026, 10:39 AM PDT
score 16.5
LLM Training Data Budget: Small Models Can Guide Large Ones
Original: Scaling Near-Optimal SFT-RL Annotation Budget Allocation from Small to Large LLMs
Source: arxiv.org ↗
Writing ELI5 summary…