从Manus到Claude Code:Agent正经历一场“六阶段”范式转移,创业者如何应对深水区?
导语:Agent赛道螺旋上升,三款现象级产品标志着Computer Use成为核心战场。本文从六阶段理论出发,拆解范式演进背后的系统工程竞争与创业机遇。
过去一年,Agent赛道经历了一轮螺旋式上升的范式循环:2025年3月,Manus以三级架构落地,首次将“数字化员工”产品化,完成全行业用户启蒙;随后OpenClaw凭借本地化部署、数据主权与轻量化体验爆火,验证了市场对AI操控电脑(Computer Use)的真实付费意愿;近期,Anthropic携原生系统级能力的Claude Code强势入场,以底层架构优势冲击工业级市场。三款现象级产品接连引爆,标志着Computer Use已成为大厂与创业者的核心战场,Agent发展正式从“单体能力比拼”进入“系统工程与生态卡位”的深水区。
在GAIR Live第27期圆桌讨论中,OpenManus核心贡献者张佳钇与Nanponova AI创始人兼CEO常楠两位实战派嘉宾,共同拆解了这场范式转移的底层逻辑。张佳钇提出的“Agent六阶段论”为当前产品划出了精准技术坐标,而常楠则从一线创业视角指出,纯效率工具正面临降维打击,垂直场景与“脏活累活”才是突破关键。本文将圆桌精华重构,深度剖析Agent进化的核心脉络与未来机遇。
Agent六阶段论:三款产品的精准定位
张佳钇提出的Agent发展六阶段分别是:第一阶段,纯语言模型调用;第二阶段,Agent for Flow(流程自动化);第三阶段,跨环境的Financial Agent;第四阶段,Agent for Coding;第五阶段,人人拥有专属Agent;第六阶段,Agent Network(智能体网络)。
“反直觉的是,技术演进顺序应为Claude Code/CodeX在前,OpenClaw在后。”张佳钇指出,正是Claude Code等工具验证了Coding与系统操控的极强可用性,才催生OpenClaw将该能力从开发者群体延伸至普通非开发者用户,完成大众化市场渗透。Manus则处于“预定义环境自主Agent”阶段,其目标、环境权限均由人类预设,更多扮演数字化员工的启蒙角色。

张佳钇以自身重度使用CodeX的经历为例,其能力经历两次显著跃迁:2025年9月时,工具已能完成约80%的科研代码工作,支持三至四小时长程执行;到2025年12月,长程执行能力进一步增强,代码产出质量有质的飞跃。“下一个阶段可能是CodeX 5.4或Opus最近推出的Computer Use功能,模型已能通过Bash工具同时处理文本、代码、GUI环境,甚至直接操控屏幕,标志着模型进入多环境任务处理空间。”这一判断为后续技术路线之争埋下伏笔。
Computer Use成为核心战场:两条路线的殊途同归
OpenClaw的爆火,本质是市场对本地操作、数据主权、隐私可控需求的集中释放,也让Computer Use正式成为Agent竞争的核心赛道。常楠认为,Computer Use解决的是人机交互的“历史遗留问题”:过去所有软件都为人类设计,GUI统治生态;而Agent时代,交互正在向计算机原生的CLI形态回归。未来应用会拥有两套接口——保留GUI供人类使用,同时搭建AI专属原生接口。当前Computer Use的爆发,核心驱动力是多模态大模型(VLM)的技术成熟,视觉能力与系统操作能力结合,让模型代劳的工作范围呈几何级扩张。
当前Computer Use形成两条核心技术路线:基于视觉VLM模拟点击(OpenClaw路线),以及通过原生指令集系统接管(Claude Code路线)。常楠分析,海外平台接口开放,原生指令集效率更高;国内内容生态高度封闭,视觉方案成为跨越“围墙花园”的主要渠道。张佳钇补充道,Computer Use的核心是为Agent获取更多上下文与权限,CLI方案在专业场景效率更高,而视觉VLM是更通用能力,能覆盖海量未知长尾场景。
但长路径决策中的幻觉积累是最大技术难点。张佳钇指出,巨头在强化学习数据规模上占据优势,而Claude Code走出的“视觉+系统指令”混合模式,成为全行业可借鉴的方向。他透露,团队内部通过Code Agency从头构建Web应用,利用状态机提取完整轨迹来获取更多数据。“数据规模确实是一个很大的问题,大家都在尝试做数据补充。”字节的UI Task项目等也在围绕视觉数据展开,整个行业正从纯UI点击向混合模式进化。
Coding是Agent的“第一性原理”:自主造工具才是真智能
本轮范式演进中,Coding的核心地位被反复强调。两位嘉宾一致认为:Coding是Agent扩展能力边界的第一基石,是Agent的第一性原理。常楠高度认可Anthropic的路径:编程不只是写代码,而是系统级问题解决。当Agent能在现有工具不足时自主编程创造新工具,才真正具备工业级价值,这也是区分“单纯效率工具”与“真正智能体”的分水岭。
“2025年初Claude Code初版受限于基座能力,随着模型迭代,Agent架构从Manus式的‘手工流’快速升级为深度‘智能体流’。”常楠回顾了自身实践,在2025年9至10月期间,他将Claude Code与现有工作流结合,构建了一套Skill Set和Harness,实现从需求分析、PRD生成、TDD到代码编写的全链路自动化,效能呈指数级提升——原本一两个月的交付周期压缩至一周。
未来理想场景是Agent网络:向网络发布任务,现有Agent无法完成时,自动协作并自主编写新工具解决问题。这正是Coding作为第一性原理的终极体现。常楠强调,“自主创造工具”的能力,让Agent能够理解系统底层逻辑并生成执行代码,才真正支撑复杂任务、长程执行与跨场景协作。
创业者生存空间:效率工具遭降维打击,垂直场景与脏活累活成壁垒
范式的快速演变,对一线创业者带来了生存空间的剧烈波动。常楠判断:基模公司必然从售卖Token延伸至产品侧与效率侧,纯效率工具类创业者将面临降维打击;而垂直场景应用开发者则迎来重大利好。他以自身团队为例,围绕Claude Code构建的全链路自动化开发工具集,已使交付周期从月级变为周级,团队能更专注于行业Know-how的沉淀。
企业需求的分化进一步加剧行业格局:大型企业极度看重过程可审计、数据私有化,倾向私有化部署;中小企业与个人用户更看重便利性,愿意适度让渡隐私。常楠指出,中国用户已习惯用隐私交换便利,而海外用户更为敏感,这解释了OpenClaw这类轻量化、本地化产品在国内获得远超硅谷的热度。
当被问及创业者如何与大厂竞争时,张佳钇建议思路转变:不要指望干掉巨头,而要为Agent打造基础设施(Infra)。“通用Computer Use虽然范围广,但效率较低,为Agent定制更快速、更原生的CLI工具和底层组件才是当下的蓝海。”常楠则从实战角度强调,唯有承接大企业不愿做的“脏活累活”,才能建立专属信任,促使客户开放独特上下文、数据与工作流,进而构建专属智能体系统,形成差异化优势。
开源社区的机遇与Claude Code泄露事件的影响
面对Claude Code这样具备OS级原生权限的正规军,开源社区的竞争策略何在?张佳钇认为,OpenClaw已给出范例:通过快速迭代增加用户实际体验中的实用功能,抢占用户心智。开源项目也应从用户实际使用体验入手,例如近期备受关注的开源项目OpenCLI,它将小红书、推特等软件变成自动CLI工具,开箱即用,虽不涉及炫酷概念,但解决真实问题,获得了大量关注。“虽然功能可能很快被巨头吃掉,但带来的信任不会被砍掉。”
Claude Code源码泄露事件引发广泛讨论。张佳钇评价称,Claude Code的工程实现非常出色,代码比OpenClaw简洁许多,其在上下文压缩、脚手架设计上的思路对开源项目有很强的借鉴意义。但脚手架本身并非闭源大厂真正的护城河,壁垒依然在于背后庞大的强化学习数据和训练闭环。常楠同样认为,泄露代码提供了极佳的工程案例,能帮助缺乏相关积淀的公司快速补齐Feature,但模型能力本身决定了产品上限,“平权”并不完全成立。
Agent的未来:个性化学习与智能体网络
展望下一轮爆发点,张佳钇预判了两大方向:一是个性化学习,Agent应从与用户的交互中持续学习个人偏好,行业急需建立个人偏好与智能体行为关联的数据标准;二是智能体网络,企业内智能体获得全员权限,处理文档、会议、协作,推动组织向AI Native转型。在社会层面,个人独特的知识技能可通过Agent进行“资产化”并对外售卖,未来Agent之间甚至能实现自动任务定价。“这一方向将在近几个月迎来重大机会。”
常楠则冷静指出,相对于内化到模型中的知识,“持续学习能力”才是核心资产。像人脉关系、客户信任等是难以被模型蒸馏的,数字化员工可能在重复性岗位上有意义,但对核心人才的替代作用有限。对于垂直赛道,他看好AI娱乐、数字生命、Agent工作平台等大厂短期不会踏足的领域,这些场景需要独特的审美品味,而AI尚未达到内容基础门槛,模型厂商重工程、轻内容的文化也留下了一定的窗口期。
结语:系统工程能力成为决胜关键
整场讨论最终指向一个核心结论:Agent竞争已彻底从“模型智力”转向“系统工程能力”。无论是VLM还是CLI路线,开源还是闭源,通用还是垂直,最终都要回归“为用户创造真实价值”的本质。张佳钇强调,模型厂商聚焦底层能力与生态构建,开源社区负责轻量化创新与用户体验补全,创业者深耕垂直场景与行业Know-how,三方形成互补共生的生态。Manus完成启蒙,OpenClaw验证需求,Claude Code定义工业级标准,三者共同推开了Agent时代的大门,而真正的产业变革,才刚刚开始。