我们为何思考

特别感谢 约翰·舒尔曼 为本文提供了大量极具价值的反馈并直接进行了修改。

测试时计算(Graves 等,2016、Ling等,2017年、Cobbe 等,2021)与思维链(CoT,Wei 等,2022、Nye 等,2021)在显著提升模型性能的同时,也引发了诸多研究问题。

本文旨在综述近年来关于如何有效利用测试时计算(即“思考时间”)及其作用机制的最新进展。

添加评论
点赞收藏
点踩分享查看原文
评论
?
参与讨论