← back
arXivJingtan Wang, Arun Verma, Xiaoqiang Lin, Zhengyuan Liu, Nancy F. Chen, Daniela Rus, Bryan Kian Hsiang LowTue, Sep 1, 2026, 10:39 AM PDT
score 16.5

LLM Training Data Budget: Small Models Can Guide Large Ones

Original: Scaling Near-Optimal SFT-RL Annotation Budget Allocation from Small to Large LLMs

Source: arxiv.org

Writing ELI5 summary…