多模态大模型能理解视频笑点吗?v-HUB基准揭秘AI幽默理解的四大短板 上海交大等团队发布v-HUB基准,评测7款多模态大模型对无台词搞笑视频的理解力。研究发现模型严重依赖文字描述,难以从视频中直接捕捉动作、声音与反差,幽默解释仍存关键短板。 AI 前沿动态# ACL 2026# Gemini# GPT-4o 3个月前420
手机 Agent 的隐私红线:点个汉堡都能泄露手机号?港中深等团队首次量化越界风险 港中深联合腾讯等团队发布 MyPhoneBench,首次量化手机 Agent 在正常任务中的隐私越界行为,包含10个模拟App、300个任务、5个模型评估,并提出 iMy 隐私交互协议。 AI 前沿动态# iMy 协议# MyPhoneBench# 大模型评估 3个月前350
AI记忆基础设施赛道新玩家:华为前实验室主任郝建业创办忆纪元,诺亚方舟再失核心人物 华为诺亚方舟实验室主任郝建业离职创立忆纪元科技,聚焦AI记忆基础设施。同期,王云鹤、唐睿明、刘武龙等核心人物也相继离职创业或加入其他公司,引发行业关注。 AI 前沿动态# AI记忆基础设施# 刘武龙# 华为诺亚方舟 3个月前410
30天融资30亿,雷军马云首次联手,千寻智能如何成为具身智能赛道最速传说? 千寻智能30天内完成两轮共30亿元融资,雷军与马云罕见联手。其技术路线与Generalist AI高度吻合,Spirit v1.5模型登顶全球,商业化落地京东与宁德时代。 AI 前沿动态 3个月前310
小米Token Plan深度实测:用「西游取经团」挑战复杂科研,真便宜了吗? 小米推出按Token消耗计费的MiMo Token Plan,我们搭建‘西游取经团’多Agent系统实测复杂科研任务,深度解析Credit模式与传统订阅制的优劣,并对比火山方舟等厂商的隐藏限制,探讨A... AI 前沿动态# Agent# AI计费# Credit 3个月前560
CVPR 2026 | 普通视频长出“空间感”!港中文薛天帆团队用CubeComposer生成4K全景视频 港中文薛天帆团队提出CubeComposer,通过时空自回归与连续性设计,首次实现从普通视角视频直接生成原生4K 360°视频,极大降低了沉浸式内容创作门槛。 AI 前沿动态# 4K全景视频生成# CubeComposer# CVPR 2026 3个月前510
推理延迟暴降72%,成本直砍76%!中大×MBZUAI开源A₁模型,打破VLA效率魔咒 | CVPR 2026 Findings 中山大学与MBZUAI联合发布开源VLA模型A₁,通过截断式自适应推理将机器人实时控制延迟降低72%,骨干计算量减少76.6%,性能不降反升。CVPR 2026 Findings收录,全面开放代码与权... AI 前沿动态# A₁# CVPR 2026# VLA 3个月前380
30亿收购后离开英伟达!前DeepMap创始人吴夏青瞄准机器人数据新赛道 前DeepMap创始人吴夏青于2025年12月离开英伟达,正考察机器人数据方向的新创业项目。其职业生涯包括谷歌、苹果、百度,创立DeepMap估值4.5亿美元,后被英伟达以约30亿美元收购。 AI 前沿动态# DeepMap# 创业# 吴夏青 3个月前300
前理想汽车总裁沈亚楠再创业!赫宇机器人瞄准家庭场景,AI Agent实体化 前理想汽车总裁沈亚楠再创业,成立赫宇机器人,从智能住宅延伸至家庭机器人,让AI Agent实体化。 AI 前沿动态 3个月前0410
不重训练!西湖大学张驰团队WorldForge实现零样本相机控制,视频生成进入4D时代 | CVPR 2026亮点 西湖大学张驰团队在CVPR 2026提出WorldForge,不改变模型参数便实现零样本相机控制,让视频生成具备空间一致性。 AI 前沿动态 3个月前0270