硅谷AI圈超级大转会!Andrej Karpathy官宣入职Anthropic,背后的技术棋局更耐人寻味
导语:大模型预训练战场突传重磅震荡,大牛Karpathy宣布空降Anthropic并主导AI自我训练。
突然引爆的社交网络:卡帕西加入Anthropic
最近,全球AI圈子迎来了一场让人直呼看不懂、却又直起鸡皮疙瘩的顶级人才变局。安德烈 · 卡帕西(Andrej Karpathy)在社交平台X上,毫无预兆地发帖宣布,自己已经正式加入Anthropic。

这行简短的公开表态,如同在沉寂了一阵子的大模型舆论场投下了一颗深水炸弹。根据Anthropic官方透露的情况,卡帕西入职后,并没有进入大家预想中的VP或者核心决策层,而是直接加入了最底层的预训练团队,向主管尼古拉斯 · 约瑟夫(Nicholas Joseph)汇报工作。卡帕西在帖子中自己也坦言,未来几年大语言模型的技术演进将进入一个极具突破性的敏感期。
这实在是一幕充满宿命感的画面。我们要知道,卡帕西本人是OpenAI的联合创始人之一,而他现在的顶头上司尼古拉斯 · 约瑟夫,此前同样是OpenAI的核心技术骨干;至于Anthropic的掌舵人达里奥 · 阿莫代(Dario Amodei),更曾经担任过OpenAI的研究副总裁。从OpenAI出走的老兵们,如今以这种方式在Anthropic完成了某种意义上的“复仇者联盟”重聚。
职级“降水”背后的战略选择:用AI来加速AI
如果光看职位抬头,卡帕西这次的决定确实叫人有些摸不着头脑。作为曾经在特斯拉直接向马斯克汇报的自动驾驶总监,以及OpenAI的创局元老,他来到Anthropic后居然要向二级主管汇报。不过,只要看一眼他的具体工作方向,这种看似“降维委屈”的疑虑就会烟消云散。
据悉,卡帕西此番的任务是帮Anthropic组建一支全新的特种小队,专门探索如何利用Claude系列大模型本身,来反哺并加速底层的预训练研究。简单用一句话概括就是:组建能用AI来自动训练和迭代AI的智能流水线。在当前全世界大模型算力成本飙升、优质人工标注数据几近枯竭的关口,这一探索方向拥有着难以估量的回报前景。这也解释了为什么Anthropic愿意为他提供近乎无限的算力供给和研究自由度。
从学术明星到工业领军:卡帕西这二十年

卡帕西的一生与其说是开挂,不如说是牢牢踏中了每一次深度学习浪潮的脉搏。这位出生于东欧的学术天才,在多伦多大学拿下了双学士,并在斯坦福读博期间投身于李飞飞门下。他不仅与李飞飞共同创立了让无数计算机视觉研究者受益匪浅的黄埔军校级课程CS231n,还在谷歌和DeepMind都留下了学术足迹。
博士毕业之后,他加入初创期的OpenAI,成为主攻生成模型与机器视觉的初代功臣。随后,马斯克亲自出马把他挖到了特斯拉。在特斯拉的五年里,卡帕西主导了Autopilot的全面升级,几乎以一己之力推动了特斯拉放弃雷达、转向纯视觉神经网络的技术路线。之后,他重返OpenAI帮助优化GPT-4,但短短一年多之后他再次选择离开,并创立了AI教育平台Eureka Labs。
即便在离职创业的业余时间,卡帕西对整个开发者群体的号召力也未曾减弱。他在2025年初公开提出了“氛围编程”(Vibe Coding)这个直击程序员痛点的词汇,指代那种不用写具体语法、完全靠跟AI交流来顺应感觉写代码的全新人机协作模式。如今,他的身份再次变为了大厂研究员。

硅谷如球场:当豪门开始招募巨星
卡帕西宣布入职的评论区里,早已塞满了同行和死忠粉的惊叹。Anthropic旗下的核心科学家、也就是Claude Code的作者鲍里斯 · 切尔尼(Boris Cherny)第一时间公开表达了欢迎,直言迫不及待要与卡帕西一起共事。

有一条非常高赞的业内评论做了一个生动的比喻:“现在的AI实验室竞争怎么越来越像英超或者欧洲杯了…… 这简直就像是俱乐部把马拉多纳给签下了一样!”
这种类比并非夸大其词。AI战场的下半场,胜负手正在悄然转移。以往各大厂拼的是几十万张显卡的暴力堆砌、拼的是数据中心的绝对功耗。但在跨入GPT-5或Claude 4的门槛时,行业发现单纯的灌水数据已经无法带来能力的指数突破。未来的赢家,必定是那些能够让大模型学会自我推演、自我纠错,从而实现软件系统自主进化的玩家。而卡帕西负责的“用大模型自监督训练下一代预训练”,正是解锁这道密码的核心钥匙。
对于正一步步扫清路障、谋划IPO的Anthropic而言,得到这样一位传奇艺术家的加盟,无疑是在估值和技术声誉上又叠加了一层重磅筹码。而相比之下,刚刚处理完诉讼纷争的OpenAI,恐怕又要拧紧发条面对更加残酷的人才防守战了。
