135亿估值!前Qwen负责人林俊旸创业,剑指Agentic Thinking新赛道

导语:前Qwen负责人林俊旸创业估值135亿,剑指Agentic Thinking新赛道。

离开阿里后,前千问大模型负责人林俊旸的最新动态终于曝光:他正式创业了。虽然公司名称尚未公开,但据The Information消息,其种子轮目标估值已高达20亿美元(约135亿元人民币),两家知名投资机构正在深入洽谈投资事宜。

林俊旸创业估值20亿美元,Agentic Thinking成新方向

对于一家尚未发布产品的中国AI初创公司而言,这一估值几乎没有先例。但相比林俊旸之前的硅谷同行,这个价格并不算贵。可见,“Qwen负责人”这个头衔的含金量之高。

Qwen前负责人创业

林俊旸于2019年加入阿里,早期专注于搜索、推荐场景下的自然语言处理和多模态建模。2020年起,他投身大规模预训练模型研究与部署,深度参与了M6等超大规模预训练模型项目——M6是阿里早期最具代表性的多模态大模型之一。2022年后,他转向通用大模型方向,并在Qwen项目成立后成为技术负责人,带队打造Qwen系列大语言与多模态模型,同时主导开源工作。Qwen后来成为阿里AI对外最清晰的技术名片,提供不同尺寸的模型、面向开发者的开源路线,以及持续更新的多模态、代码和轻量化版本。对开发者而言,Qwen是真正可下载、可微调、可部署、可二次开发的实用模型——这也是他创业备受关注的底层原因。

那么,林俊旸下一步到底想做什么?在他离职后发布的一篇长文中,或许可以找到线索。

首篇长文给出线索:Agentic Thinking

林俊旸离职后的首篇长文标题为《From “Reasoning” Thinking to “Agentic” Thinking》。这既是对过去一年模型竞争的复盘,也像是下一阶段创业方向的技术宣言。

林俊旸创业估值20亿美元,Agentic Thinking成新方向

他的判断可以浓缩为一句话:上一阶段的AI竞争是让模型更会思考;下一阶段的竞争是让模型为了行动而思考。思考模型花费更多推理算力,借助强化学习获得更稳定的反馈,数学、代码、逻辑等可验证任务成为核心训练场景。但林俊旸认为,问题已经开始变化——尤其是在代码和智能体工作流中,真正重要的是代码库导航、计划拆解、错误恢复、工具编排以及长时间执行任务的质量。

这引出了全文核心概念:Agentic Thinking。林俊旸将其定义为一种“为了行动而思考”的能力。它不只是让模型在回答前想更久,而是让模型在环境中行动、观察反馈、修正计划,再继续推进。推理浪潮的第一阶段确立了一件重要的事:当反馈信号可靠且基础设施能够支撑时,语言模型之上的强化学习可以产出质的飞跃的认知能力。更深层的转变是从推理式思考到智能体式思考:从想得更久,到为了行动而想。训练的核心对象已经改变——它变成了模型+环境的系统,或者更具体地说,是智能体和围绕它的编排框架。

这改变了哪些研究要素最重要:模型架构和训练数据当然仍然重要,但环境设计、轨迹采样基础设施、评估器鲁棒性以及多智能体之间的协调接口同样关键。这也改变了“好的思考”的定义:最有用的轨迹,是能在真实世界约束下维持有效行动的那个——而非最长或最醒目的那个。这也改变了竞争优势的来源:在推理时代,优势来自更好的强化学习算法、更强的反馈信号和更可扩展的训练流水线;在智能体时代,优势将来自更好的环境、更紧密的训练-推理耦合、更强的编排工程,以及在模型的决策与这些决策产生的后果之间实现闭环的能力。

One More Thing

自发布探讨Agentic Thinking的长文后,林俊旸的个人社交媒体账号便没有再发声,不过转发了一条关于持续学习基准测试的消息。这是否与他的创业方向相关?值得关注。

林俊旸创业估值20亿美元,Agentic Thinking成新方向

参考链接:https://x.com/jingyanghk/status/2054450088400093359

© 版权声明

相关文章

暂无评论

none
暂无评论...