Sutton团队新论文破解流式强化学习难题:一个1967年公式,让AI“边做边学”更稳定Richard Sutton参与的新论文提出“意图更新”,用期望输出变化反推步长,在无回放、批量为1的流式强化学习中显著提升稳定性。AI 前沿动态4个月前0540
企业AI音乐迁移加速:为什么越来越多团队从Suno转向国产Mureka?多家企业正在从Suno迁移到国产AI音乐Mureka。本文拆解Sondo、快歌和海外头部平台的选择逻辑,以及V8/V9如何推动AI音乐进入企业可用阶段。AI 前沿动态4个月前0430
Thinking Machines首个交互模型亮相:200ms微回合、实时多模态,向“一问一答”AI告别Thinking Machines发布首个交互模型TML-Interaction-Small,以200ms微回合、早期多模态融合和后台agent实现实时自然协作。AI 前沿动态4个月前0370
Dexbotic接入RLinf:具身智能研发迎来“SFT+RL”一体化新范式Dexbotic正式支持RLinf作为分布式强化学习后端,打通VLA模型SFT与RL后训练流程,推动具身智能研发走向一体化。AI 前沿动态4个月前0470
字节开源DreamLite:0.39B轻量统一扩散模型,手机上3秒完成生图与改图字节开源DreamLite,0.39B轻量统一扩散模型可在手机端同时实现文生图与图像编辑,iPhone 17 Pro上约3秒出图,支持离线运行。AI 前沿动态4个月前0460
少步扩散模型也能持续进化:D-OPSD让图像生成实现“边采样边学习”D-OPSD将在线策略自蒸馏引入少步扩散模型,无需奖励模型即可在保持少步采样能力的同时学习新概念、新风格,支持LoRA与全量微调。AI 前沿动态4个月前0450
推理为什么总卡顿?前谷歌 TPU 架构师拆解:算力之外,显存带宽、KV Cache 与并发才是关键前谷歌 TPU 架构师 Reiner Pope 解析大模型推理为何会卡顿:显存带宽、批处理、KV Cache、长上下文和 MoE 通信墙如何共同限制速度与成本。AI 前沿动态4个月前0690
arXiv祭出重拳:AI生成论文不核查直接封号一年,连坐所有作者arXiv发布新规:若论文中AI生成内容未经核查(如虚构引用),将禁投一年,且后续需经同行评议。同时,多位AI顶会已出台类似惩罚措施,学术界对AI滥用进入实操治理阶段。AI 前沿动态4个月前0450
亚马逊内部KPI催生荒谬‘Tokenmaxxing’:员工为刷Token滥用AI工具!亚马逊将Token消耗纳入KPI,员工为刷榜滥用AI工具,催生‘Tokenmaxxing’荒诞现象。背后是2000亿美元投资焦虑,还引发安全隐患。AI 前沿动态4个月前0490
从Agent到赛博员工:AI生产力智能的涌现与下一站竞争当AI从“会干活”走向“真上岗”,赛博员工成为生产力新单位。本文解析Workspace-Bench测评揭示的Agent瓶颈,探讨工作站、角色与工作规模的Scaling新维度,以及生产力智能如何涌现。AI 前沿动态4个月前0480