给视频生成装上“物理外脑”:NTU团队提出VChain,用视觉推理解决画面“穿帮”难题 视频生成模型常因缺乏物理常识导致画面穿帮。南洋理工大学团队推出VChain框架,首次引入“视觉思维链”机制。该方案利用多模态大模型进行逻辑推演并指导视频生成,在常识与因果规律测评中表现优异,零重训实现... AI 前沿动态# VChain# 多模态大模型# 大模型推理 2个月前370
100亿美元赌局:世界模型如何从“在梦里学开车”进化成机器人终极大脑? 深度解析世界模型概念的起源、两条独立研究脉络及其在2025年的融合,揭示当前技术能力边界与百亿资本背后的战略格局。 AI 前沿动态# AI# Dreamer# Genie 2个月前580
仅凭初始与目标姿态,PAM生成高保真手物交互视频!智源清华新作入选CVPR 2026 智源清华等提出PAM框架,仅需初始与目标手部姿态及物体几何即可生成高保真手物交互视频。无需第一帧输入,性能全面超越现有SOTA,其合成数据可大幅提升下游手部姿态估计任务,用50%真实数据即可达到全量数... AI 前沿动态# CVPR 2026# HOI# PAM 2个月前400
CVPR 2026 | 让视频生成遵循物理法则:ProPhy的分层物理对齐方法 中山大学梁小丹团队在CVPR 2026提出的ProPhy,通过分层物理对齐大幅减少视频生成中的物理违规现象,从视觉真实迈向物理正确。 AI 前沿动态# CVPR 2026# ProPhy# 世界模型 2个月前470
CVPR 2026|川大雷印杰团队:给视频生成注入物理定律,过程终于不再“出戏” 四川大学雷印杰团队在CVPR 2026提出新方法,通过事件链和物理公式约束视频生成,大幅提升过程合理性和时间顺序正确性,在多个物理场景中取得最佳效果,让生成视频不再“出戏”。 AI 前沿动态# CVPR 2026# 事件链# 关键帧 2个月前520