
It puts a sharp empirical edge on the data-efficiency gap between human learning and scaling, which is the argument underneath most of the debate.
articleModular Cognitive Architecture Emerges in Large Language ModelsPengrui Han, Jacob Andreas, Evelina Fedorenko, Andrea Gregor de Varda
articleBetter, Faster, Stronger: Programmatic Skill Learning Best Reduces Agent CostZixi Huang, Xiheng Wang, Andrew Wang, William Jurayj, Bernal Jim\'enez Guti\'errez, Daniel Khashabi, Nicholas Andrews
articleGRPO Beyond English: A Large-Scale Study of GRPO in Non-English and Multilingual SettingsKonstantin Dobler, Federico Scozzafava, Jonathan Janke, Mohamed Ali, Simon LehnererSign in to comment.
Loading comments…