前阿里千问大模型技术负责人离职后发长文,推理链越长不等于模型越聪明

市场资讯 2026-03-27 14:28:10
10秒看完全文要点
看要点

据第一财经消息,3月26日晚间,前阿里千问大模型技术负责人林俊旸在社交平台发布离职后的首篇长文,围绕AI技术演进方向分享系统性思考,提出行业正从推理式思考阶段迈向智能体式思考阶段。

林俊旸表示,过去两年重塑了行业对大模型的评估方式与核心期待。OpenAI的o1证明“思考”可以成为被训练的核心能力,DeepSeek-R1则验证推理式后训练可在实验室外复现扩展。2025年上半年,行业聚焦于让模型在推理时“多想一会儿”,但这一阶段使命已完成,行业需进入下一阶段。

他透露,2025年初千问团队曾尝试打造统一系统,将思考模式与指令模式合二为一,让模型自主决定思考深度,但实践中发现两种模式数据分布与行为目标存在显著差异,强行融合易导致两端表现平庸。2025年下半年,Qwen 2507版本最终发布独立的指令与思考版本。林俊旸认为,真正成功的合并需要构建平滑的推理力度光谱,让模型自主判断思考投入程度。

“推理链更长,不等于模型更聪明。很多时候,推理链越长,反而说明模型在乱花算力。”林俊旸在文中直言,行业正从训练模型的时代走向训练智能体的时代,智能体思维核心是为行动而思考,在与环境交互中根据反馈持续更新计划。

他指出,智能体思维的核心问题从“模型能不能想得够久”转变为“能不能用撑得起有效行动的方式思考”,训练核心对象从单一模型变为模型加环境的整体系统,环境设计、评估器稳健程度、多智能体协调等均进入核心关注范畴。

声明:市场有风险,投资需谨慎。本文为AI基于第三方数据生成,仅供参考,不构成个人投资建议。

财经频道更多独家策划、专家专栏,免费查阅>>

金融界提醒:本文内容、数据与工具不构成任何投资建议,仅供参考,不具备任何指导作用。股市有风险,投资需谨慎!
全部评论
谈谈您的想法...
AI解读分析
打开App
推荐 要闻 7x24 理财 财 经 导航