仅凭初始与目标姿态,PAM生成高保真手物交互视频!智源清华新作入选CVPR 2026 智源清华等提出PAM框架,仅需初始与目标手部姿态及物体几何即可生成高保真手物交互视频。无需第一帧输入,性能全面超越现有SOTA,其合成数据可大幅提升下游手部姿态估计任务,用50%真实数据即可达到全量数... AI 前沿动态# CVPR 2026# HOI# PAM 2个月前400