CVPR 2026|川大雷印杰团队:给视频生成注入物理定律,过程终于不再“出戏” 四川大学雷印杰团队在CVPR 2026提出新方法,通过事件链和物理公式约束视频生成,大幅提升过程合理性和时间顺序正确性,在多个物理场景中取得最佳效果,让生成视频不再“出戏”。 AI 前沿动态# CVPR 2026# 事件链# 关键帧 2个月前520
CVPR 2026 | 普通视频长出“空间感”!港中文薛天帆团队用CubeComposer生成4K全景视频 港中文薛天帆团队提出CubeComposer,通过时空自回归与连续性设计,首次实现从普通视角视频直接生成原生4K 360°视频,极大降低了沉浸式内容创作门槛。 AI 前沿动态# 4K全景视频生成# CubeComposer# CVPR 2026 2个月前510
只用双人数据训练,就能生成七人舞蹈动画!中科院计算所与上交大CVPR 2026新作颠覆多人物视频生成 中科院计算所与上海交大提出MultiAnimate框架,仅用双人数据训练即可生成多达七人的高一致性动画,解决多人交互中的身份混淆与空间错位问题,效果显著优于现有方法。 AI 前沿动态# CVPR 2026# 上海交大# 人物掩码 2个月前480
CVPR 2026 | 让视频生成遵循物理法则:ProPhy的分层物理对齐方法 中山大学梁小丹团队在CVPR 2026提出的ProPhy,通过分层物理对齐大幅减少视频生成中的物理违规现象,从视觉真实迈向物理正确。 AI 前沿动态# CVPR 2026# ProPhy# 世界模型 2个月前470
1000万数据+统一验证框架!浙大腾讯打破图像编辑「规模-质量」魔咒,开源模型直逼闭源SOTA|CVPR 2026 浙大与腾讯团队提出UnicEdit-10M千万级图像编辑数据集和UnicBench基准,通过统一验证框架大幅提升开源模型编辑质量,在多项指标上接近闭源模型,为图像编辑研究提供新方向。 AI 前沿动态# CVPR 2026# Qwen-Verify# UnicBench 2个月前450
仅凭初始与目标姿态,PAM生成高保真手物交互视频!智源清华新作入选CVPR 2026 智源清华等提出PAM框架,仅需初始与目标手部姿态及物体几何即可生成高保真手物交互视频。无需第一帧输入,性能全面超越现有SOTA,其合成数据可大幅提升下游手部姿态估计任务,用50%真实数据即可达到全量数... AI 前沿动态# CVPR 2026# HOI# PAM 2个月前400
数据充足为何训练失败?中山大学团队提出MangoBench,揭示多智能体离线强化学习核心瓶颈 中山大学郭裕兰团队在CVPR 2026提出MangoBench基准,系统性分析多智能体离线强化学习在稀疏奖励与信用分配下的困境,揭示目标驱动与分层策略的有效性,为协作智能指明方向。 AI 前沿动态# CVPR 2026# MangoBench# 中山大学 2个月前390
CVPR 2026 | 多模态大模型如何看懂物种关系?北大团队提出TARA,层级识别准确率大幅提升 北京大学王选所彭宇新团队提出TARA方法,通过生物基础模型对齐表征,显著提升多模态大模型在层级视觉识别中的一致性表现,并大幅增强对未知物种的泛化能力,论文入选CVPR 2026。 AI 前沿动态# CVPR 2026# TARA# 北大彭宇新团队 2个月前390
推理延迟暴降72%,成本直砍76%!中大×MBZUAI开源A₁模型,打破VLA效率魔咒 | CVPR 2026 Findings 中山大学与MBZUAI联合发布开源VLA模型A₁,通过截断式自适应推理将机器人实时控制延迟降低72%,骨干计算量减少76.6%,性能不降反升。CVPR 2026 Findings收录,全面开放代码与权... AI 前沿动态# A₁# CVPR 2026# VLA 2个月前380
CVPR 2026 | 机器人不再“健忘”!西湖大学HiF-VLA让机械臂通晓过去、现在与未来 西湖大学王东林团队提出HiF-VLA模型,通过运动信息让机器人记住过去并预判未来,在长序列任务中成功率最高达96.4%,推动具身智能从“看到就做”走向“边想边做”。本文详解方法、实验与背后的科研力量。 AI 前沿动态# CVPR 2026# HiF-VLA# 具身智能 2个月前360