降本90%性能却直追Opus 4.7!Cursor闪击发布Composer 2.5,背后竟藏着Kimi底座与马斯克的算力局 Cursor正式推出Composer 2.5模型,彻底解决AI编程工具成本高昂且长任务执行不稳定的痛点。新一代模型基于月之暗面K2.5构建,以十分之一的价格提供媲美Opus 4.7的超凡性能,重塑大模... AI 前沿动态# AI编程助手# Composer 2.5# Cursor 2个月前370
告别盲目随机探索!国防科大等团队巧用“参数变化”,带强化学习走出训练深水区 强化学习无监督环境设计面临关卡价值评估开销大、方差高的痛点。国防科大等提出PACE算法,用策略参数变化量度量学习进展,精准定位最近发展区。实验显示该算法避开了额外评估开销,并在MiniGrid与Cra... AI 前沿动态# PACE算法# 强化学习# 无监督环境设计 2个月前320
告别繁杂工具流!Meta联合港中文提出ATLAS:用单个Token重塑低功耗视觉推理 Meta ATLAS视觉推理方案针对多模态大模型开销大、依赖工具的痛点,创新提出用单个Token统一Agent动作与隐式思考。该方案通过SFT与LA-GRPO机制,在不改动原架构下,显著降低推理成本... AI 前沿动态# ATLAS# LA-GRPO# 多模态大模型 2个月前270
拆解AlphaGo的技术遗产:为什么大模型难以直接复制树搜索奇迹? 大语言模型强化学习面临信用分配与梯度方差暴增的痛点。前DeepMind科学家Eric Jang深入剖析AlphaGo,指出其依靠MCTS与价值网络进行状态重标记分摊搜索空间,而LLM因词表庞大且无规则... AI 前沿动态# AlphaGo# MCTS# 信用分配 2个月前340
手撕45公斤冰箱!波士顿动力新Atlas大秀肌肉,干重活的人形机器人终于成了? 波士顿动力最新Atlas机器人攻克了人形机器人无法感知重力与接触力的行业痛点。通过仿真强化学习与全身协调控制,Atlas成功在现实中抱起超45公斤的满载冰箱,标志着具身智能从做细活正式跨入重工业级体力... AI 前沿动态# Atlas机器人# 人形机器人# 强化学习 2个月前320
独家爆料!前Kimi强化学习核心专家离职创业,领衔「十六号机器人」直奔通用具身大模型终极战场! 前月之暗面核心强化学习研究员宋鸿涌博士(Flood Sung)正式离职创立“十六号机器人”(XVI Robotics),聚焦通用人形机器人基座模型研发,打造打通大模型数字推理到物理世界的终极控制大脑。 AI 前沿动态# Flood Sung# Kimi大模型# XVI Robotics 2个月前410
100亿美元赌局:世界模型如何从“在梦里学开车”进化成机器人终极大脑? 深度解析世界模型概念的起源、两条独立研究脉络及其在2025年的融合,揭示当前技术能力边界与百亿资本背后的战略格局。 AI 前沿动态# AI# Dreamer# Genie 2个月前580
多跳推理性能飙升20%!Search-R2将纠错纳入策略空间,破解搜索增强推理的长链信用分配难题 腾讯混元、MBZUAI和港中文联合提出Search-R2框架,将纠错纳入强化学习策略空间,有效解决长链搜索推理中的错误传播问题,在多跳推理任务中性能提升超20%,为搜索型智能体提供了更贴近真实失败模式... AI 前沿动态# MBZUAI# Search-R2# 信用分配 2个月前300
ICLR 2026 | 清华刘洋团队震撼发现:8B小模型问诊吊打70B大模型,医疗AI的真正救命能力原来不是背书! 清华刘洋团队在ICLR2026发表重磅论文,提出DOCTOR-R1框架,用8B小模型在动态问诊中超越70B大模型,揭示医疗AI的真正瓶颈在于提问策略而非知识规模。 AI 前沿动态# 8B模型# DOCTOR-R1# ICLR2026 2个月前370
告别“换脸”尴尬,西交大 x A*STAR 用成对奖励建模让 AI 生成真正一致的多图! 西安交通大学与新加坡 A*STAR 团队提出的 PaCo-RL,通过成对比较奖励模型与强化学习,解决了 AI 多图生成中身份、风格不一致的难题,让连续创作成为可能。 AI 前沿动态# A*STAR# CVPR 2026# PaCo-RL 2个月前330