从 Manus 到 Claude Code:Agent 进入深水区,开源与巨头的终极暗战 Agent从概念Demo进入深水区,Manus启蒙、OpenClaw验证、Claude Code收割,开源与闭源激战正酣。剖析技术路线、工程挑战与创业者的生存之道。 AI 前沿动态# Agent# Claude Code# Manus 3个月前290
一秒钟生成成本不到一毛钱!00后CEO如何把3D打印的“卷”变成世界模型的护城河 00后创业者陈天润带领魔芯科技转型空间智能,意外发现世界模型的Scaling Law,凭借端侧部署与消费电子级成本控制,实现视频生成每秒不到一毛钱,获华为联想数亿融资。本文深度拆解其技术路径与商业化逻... AI 前沿动态# 3D打印# Scaling Law# 世界模型 3个月前440
ICML 2026 AI for Math Workshop征稿启动!四大挑战赛聚焦自进化科学智能体 第三届AI for Math Workshop将于ICML 2026在首尔举行,聚焦自进化科学智能体。征稿涵盖形式化证明、多模态推理等八大主题,并设四项挑战赛。 AI 前沿动态# AI for Math# ICML 2026# 形式化定理证明 3个月前450
AI制药深水区交锋:从蛋白质预测到临床折戟,我们离“死亡之谷”还有多远? AI制药进入深水区,从蛋白质预测到临床折戟,死亡之谷如何跨越?本场圆桌邀请顶尖专家探讨算法底座、系统生物学和临床反馈,直击AI药物研发最残酷的临床试金石。 AI 前沿动态# AI制药# AlphaFold# 临床折戟 3个月前410
SFT只会记忆?最新研究颠覆认知:泛化能力由优化、数据与模型三方共同决定! 最新研究重新审视SFT泛化,发现泛化并非固有属性,而是受优化动态、训练数据和模型能力共同影响的条件性现象,本文深度解读三个关键因素的实验证据。 AI 前沿动态# AI# SFT# 优化动态 3个月前350
当AI学会“视觉规划”:EAR范式首次系统评测图像编辑模型的推理潜力 上海交大与BIGAI提出EAR范式,将视觉规划任务转化为单步图像编辑,通过AMAZE基准系统评测模型的视觉推理能力,揭示扩散模型潜力与差距。 AI 前沿动态# AMAZE基准# EAR范式# Maze 3个月前310
多模态大模型能理解视频笑点吗?v-HUB基准揭秘AI幽默理解的四大短板 上海交大等团队发布v-HUB基准,评测7款多模态大模型对无台词搞笑视频的理解力。研究发现模型严重依赖文字描述,难以从视频中直接捕捉动作、声音与反差,幽默解释仍存关键短板。 AI 前沿动态# ACL 2026# Gemini# GPT-4o 3个月前420
手机 Agent 的隐私红线:点个汉堡都能泄露手机号?港中深等团队首次量化越界风险 港中深联合腾讯等团队发布 MyPhoneBench,首次量化手机 Agent 在正常任务中的隐私越界行为,包含10个模拟App、300个任务、5个模型评估,并提出 iMy 隐私交互协议。 AI 前沿动态# iMy 协议# MyPhoneBench# 大模型评估 3个月前350
AI记忆基础设施赛道新玩家:华为前实验室主任郝建业创办忆纪元,诺亚方舟再失核心人物 华为诺亚方舟实验室主任郝建业离职创立忆纪元科技,聚焦AI记忆基础设施。同期,王云鹤、唐睿明、刘武龙等核心人物也相继离职创业或加入其他公司,引发行业关注。 AI 前沿动态# AI记忆基础设施# 刘武龙# 华为诺亚方舟 3个月前410
30天融资30亿,雷军马云首次联手,千寻智能如何成为具身智能赛道最速传说? 千寻智能30天内完成两轮共30亿元融资,雷军与马云罕见联手。其技术路线与Generalist AI高度吻合,Spirit v1.5模型登顶全球,商业化落地京东与宁德时代。 AI 前沿动态 3个月前310