CVPR 2026 | 多模态大模型如何看懂物种关系?北大团队提出TARA,层级识别准确率大幅提升 北京大学王选所彭宇新团队提出TARA方法,通过生物基础模型对齐表征,显著提升多模态大模型在层级视觉识别中的一致性表现,并大幅增强对未知物种的泛化能力,论文入选CVPR 2026。 AI 前沿动态# CVPR 2026# TARA# 北大彭宇新团队 2个月前390
黄仁勋万字演讲精华:AI计算需求暴增100万倍背后的万亿美元蓝图 2026年GTC上,黄仁勋揭示AI计算需求两年暴增100万倍,发布Vera Rubin平台与开源智能体操作系统OpenClaw,详细解读万亿美元产业蓝图。 AI 前沿动态# Agentic AI# AI计算需求# CPO 2个月前390
中国具身智能逆袭!星动纪元「具身奥林匹克」三项全球第一,徒手剥橘碾压PI 中国具身智能公司星动纪元在Benjie's Humanoid Olympic Games中,于剥橘子、开锁、翻袜子三项任务均斩获全球第一,击败行业巨头PI,实现小样本泛化与毫米级操控突破,标志具身智能... AI 前沿动态# Benjie's Olympics# Physical Intelligence# PI 2个月前390
专访AI异类弗兰克:我让AI当CEO,QLab的蜂群实验与超体未来 对话AI异类弗兰克,揭秘QLab如何让AI担任CEO,以蜂群式agent网络重构创业孵化。从OpenClaw生态到超体想象,探讨AI时代的新商业范式与全球市场机遇。 AI 前沿动态# AI agent# AI CEO# AI创业 2个月前390
几小时让机器人「跑起来」!中山大学开源 PhyAgentOS,终结具身智能真机部署噩梦 中山大学HCP实验室开源PhyAgentOS,通过六层协议化架构实现从仿真到真机的一键部署,支持多机器人协同和白盒调试,让机器人开发告别“论文看懂、真机跑废”的困境。 AI 前沿动态# PhyAgentOS# 中山大学# 具身智能 2个月前390
文生图告别“参数玄学”:清华段岳圻团队用控制论重写CFG,画质与语义稳定双赢 清华大学段岳圻团队提出CFG-Ctrl,将文生图引导机制从经验调参升级为控制系统设计,利用滑模控制打破语义对齐与图像质量的传统对立,在高guidance scale下依然保持稳定,多模型实验验证其普适... AI 前沿动态 2个月前390
实测 Happy Horse-1.0:阿里首款视频模型如何让 AI“听懂戏”,拍出电影级质感? 阿里ATH事业群推出Happy Horse-1.0视频模型,在Arena和Artificial Analysis盲测中名列前茅。本文通过极限压力测试,全面评测其电影级叙事能力、多镜头一致性、音画同步... AI 前沿动态 2个月前390
CVPR 2026 3D视觉五大突破:模型正在学会理解、生成并构建真实世界 CVPR 2026 3D视觉研究重点转向空间智能,从自监督重建、实时新视角合成到4D物理生成,本文梳理五大突破性工作,揭示模型如何学会理解、生成和构建三维世界。 AI 前沿动态 2个月前390
前华为出海高管胡德波二次创业,「索塔无界」剑指通用基座模型与海外市场 前华为出海高管胡德波二次创业成立索塔无界,聚焦通用基座模型与海外市场,提出物理智能大脑技术路线,已获欧美商业巨头合作意向。 AI 前沿动态 2个月前390
从解释黑箱到设计玻璃箱:ACL 2026综述揭秘大模型内生可解释性的五大路线 ACL 2026综述论文提出大模型内生可解释性的五大设计范式:功能透明性、概念对齐、表征可分解性、显式模块化、潜在稀疏性诱导,推动从“事后解释”到“玻璃箱设计”的范式转变。 AI 前沿动态 2个月前0390