
Self-consistency only helps when sampled reasoning paths actually differ. Training with global forking gives a single model explicit handles for distinct reasoning modes, so diversity comes from the model rather than temperature.
articleCategories of Inference-Time Scaling for Improved LLM ReasoningSebastian Raschka, PhD
articleControlling Reasoning Effort in LLMsSebastian Raschka, PhD
articleAre the Financial Reasoning from LLMs Credible? A Real World Test over Long-Horizon StatementsXinke Tong, Xuanming Zhang, Tianyi Tang, An Yang, Jiatu Hu, Guojie Lin, Zhenzhen Shi, Lingfeng Zeng, Boyu Yang, Bing Zhao, Hu Wei, Lin Qu, Dayiheng LiuChecking sign-in…
Loading comments…