胸片AI迈入“可验证推理”阶段:CX-Mind如何让诊断过程可追溯、可复核?上海交通大学、上海创智学院与瑞金医院发布CX-Mind,将胸片诊断推进到可验证推理链阶段,在多数据集和真实世界评测中表现领先。AI 前沿动态4个月前0470
xAI推出首个终端 Coding Agent:Grok Build 上线,直面 Claude Code 与 Cursor 竞争xAI推出首个Coding Agent Grok Build,支持终端运行、子智能体并行、计划模式与工作流兼容,面向专业开发者开放。AI 前沿动态4个月前0470
MoE路由也能“长记性”:RMS-MoE用历史专家协作降低推理成本WWW 2026论文RMS-MoE提出检索记忆协同路由,让MoE复用历史专家组合,在WebQA和MultiWOZ上提升准确率并降低延迟。AI 前沿动态4个月前0470
Dexbotic接入RLinf:具身智能研发迎来“SFT+RL”一体化新范式Dexbotic正式支持RLinf作为分布式强化学习后端,打通VLA模型SFT与RL后训练流程,推动具身智能研发走向一体化。AI 前沿动态4个月前0470
GPT-5.5与Claude Opus 4.7新智商测试惨败!得分不足1%人类却拿满分OpenAI GPT-5.5和Anthropic Claude Opus 4.7在最新ARC-AGI-3测试中得分低于1%,而人类未经训练即可100%通过。本文深度剖析三大失败模式及模型本质差异。AI 前沿动态4个月前0470
英伟达的护城河不止CUDA!黄仁勋揭秘“token工厂”与TPU竞争格局黄仁勋最新专访揭秘英伟达护城河:不止CUDA,还有五层全栈生态、2500亿美元供应链绑定及AI智能体带来的需求爆发。对比TPU,解析英伟达加速计算平台的不可替代性。AI 前沿动态4个月前0470
ChatGPT为何拼命“接住你”?从模式坍塌到AI谄媚的深度解析ChatGPT近期高频使用“我会稳稳接住你”,引发用户集体吐槽。这背后不仅是翻译错误,更是模式坍塌与AI谄媚的体现。本文从技术、语言、心理等多维度深度解析这一现象。AI 前沿动态4个月前0470
73亿美元!DeepSeek创中国AI融资纪录:梁文锋自掏200亿,估值飙至3500亿DeepSeek完成73亿美元融资,估值515亿美元,创中国AI融资纪录。创始人梁文锋自掏200亿元,腾讯及国家AI基金参与。资金将用于算力获取和商业化扩张。AI 前沿动态4个月前0470
量化精度也能动态分配?华为等发布QuantClaw,为AI Agent省21%成本还提速15%华为联合新加坡国立大学、中科大提出QuantClaw,一个为OpenClaw设计的动态精度路由插件。基于大规模量化实证研究,实现质量提升、成本降低21%、延迟减少15%,打造更高效的Agent系统。AI 前沿动态4个月前0470
Auto Research 最后一块拼图:Frontier-Eng Bench 如何衡量 AI 的工程优化极限?Frontier-Eng Bench 是专为 AI 工程优化能力设计的基准,涵盖 47 个真实任务,测量 Agent 在固定预算内持续迭代改进方案的能力,揭示双重幂律衰减等规律。AI 前沿动态4个月前0470