仅凭初始与目标姿态,PAM生成高保真手物交互视频!智源清华新作入选CVPR 2026智源清华等提出PAM框架,仅需初始与目标手部姿态及物体几何即可生成高保真手物交互视频。无需第一帧输入,性能全面超越现有SOTA,其合成数据可大幅提升下游手部姿态估计任务,用50%真实数据即可达到全量数...AI 前沿动态# CVPR 2026# HOI# PAM4个月前580
视觉逼真≠能干活!清华团队WorldArena撕开世界模型“华而不实”的假面对话清华商宇,深度解读WorldArena评测平台如何揭示世界模型在视觉质量与功能可用性之间的巨大断层,并推动训练范式从视频生成向视频-动作联合建模转变,成为CVPR 2026关键竞赛之一。AI 前沿动态4个月前580
CVPR 2026 重磅亮点:LEADER 让激光雷达重定位同时拿下精度与速度厦门大学与布里斯托大学提出 LEADER 激光雷达重定位方法,在保持十毫秒级效率的同时显著提升精度,NCLT 上优于 APR、SCR 和检索配准方法。AI 前沿动态4个月前0580
万帧级照片级仿真来了!GS-Playground如何重塑视觉机器人训练基础设施清华AIR等团队提出GS-Playground,以3DGS渲染、自研物理引擎和自动化资产流水线实现万帧级照片级机器人仿真。AI 前沿动态4个月前0580
ICLR 2026 Oral重磅:大模型“想太多”有解!DECS让推理Token砍半,准确率反升2.5%ICLR 2026 Oral论文DECS从理论揭示长度惩罚缺陷,提出解耦奖励与课程调度,实现推理Token减少超50%,准确率提升2.5个百分点。AI 前沿动态4个月前0580
连CPU都能跑!0.5G超低内存白嫖本地端侧AI桌宠,附保姆级部署源码MiniCPM5-1B端侧大模型正式开源!本文为你提供超实用的本地部署与微调指南,低至0.5GB内存即可运行,并附带AI桌宠一键安装包及ForgeTrain训练框架等核心开源链接,让普通电脑轻松白嫖本...AI 前沿动态# AI桌宠# MiniCPM5-1B# 开源源码4个月前570
帧跃科技拿下千万美元天使轮:华为云老兵押注“可交互视频”帧跃科技完成千万美元天使轮融资,AI交互式视频仍缺可控生成平台。公司以Leadde整合DiT、代码生成和物理渲染,目标切入企业级实时视频基础设施。AI 前沿动态# AI交互式视频# DiT视频生成# Leadde4个月前570
别被AI借口骗了!arXiv狂砍“四刀”封杀CS综述,新人发文被逼入绝境,真相竟是平台要自立门户?学术预印本平台arXiv在半年内连续推出禁收CS综述论文、严苛背书机制等四大政策。本文起底AI审稿泛滥的死循环与arXiv脱离康奈尔大学、转型独立运行机构的幕后战略。AI 前沿动态# AI学术水文# arXiv拒收综述# arXiv背书新政4个月前570
「屏幕图灵测试」曝光:大模型 GUI Agent 如何绕过平台检测实现“拟人化生存”多模态大模型驱动的GUI Agent面临平台检测危机,上海交大与CMU团队提出“屏幕图灵测试”与AHB基准,系统剖析原生Agent的机械印记,通过历史匹配、伪动作注入等策略探索拟真度与实用性的帕累托前...AI 前沿动态# AHB基准# GUI Agent# 反检测4个月前570
数据充足为何训练失败?中山大学团队提出MangoBench,揭示多智能体离线强化学习核心瓶颈中山大学郭裕兰团队在CVPR 2026提出MangoBench基准,系统性分析多智能体离线强化学习在稀疏奖励与信用分配下的困境,揭示目标驱动与分层策略的有效性,为协作智能指明方向。AI 前沿动态# CVPR 2026# MangoBench# 中山大学4个月前570