番茄
暂无简介
提交点赞
当语言模型逐渐擅长使用工具后,我曾经很认同这样一种观点:与其一味把语言模型做大,不如打磨出一个足够强的"认知核心"——比如十亿参数规模——剩下的事情交给工具去做就行,比如上网浏览或执行代码。我猜很多人都认同这个逻辑,毕竟很难想出一个原则上做不到的任务:只要工具调用权限给得够多,一个十亿参数的模型理论上什么都能干。举个例子,大模型知道的任何冷门知识,原则上都可以让一个十亿参数模型自己上网查、自己推理...
评论点赞收藏30 天前