告别盲目随机探索!国防科大等团队巧用“参数变化”,带强化学习走出训练深水区 强化学习无监督环境设计面临关卡价值评估开销大、方差高的痛点。国防科大等提出PACE算法,用策略参数变化量度量学习进展,精准定位最近发展区。实验显示该算法避开了额外评估开销,并在MiniGrid与Cra... AI 前沿动态# PACE算法# 强化学习# 无监督环境设计 2个月前340
拆解AlphaGo的技术遗产:为什么大模型难以直接复制树搜索奇迹? 大语言模型强化学习面临信用分配与梯度方差暴增的痛点。前DeepMind科学家Eric Jang深入剖析AlphaGo,指出其依靠MCTS与价值网络进行状态重标记分摊搜索空间,而LLM因词表庞大且无规则... AI 前沿动态# AlphaGo# MCTS# 信用分配 2个月前340
仅用0.05%数据换来22.9倍提速!FlashAR如何解决自回归图像生成的『慢病』? 自回归图像生成模型长期面临推理延迟高、难以实时部署的行业痛点。浙大与阿德莱德大学联合提出FlashAR轻量化后训练加速框架,仅用0.05%的微量训练数据,在保证生成质量近乎无损的基础上,成功斩获高达2... AI 前沿动态# Emu3.5# FlashAR# 加速算法 2个月前340
国产模型再证实力!Qwen 3.7 Max预览版深夜突袭,LMSYS竞技场上演“双星登顶” 通义千问Qwen3.7-Max-Preview震撼空降LMSYS竞技场,彻底打破了国产大模型的出海排位局。阿里此次携Max与Plus双版并发,不仅拿下国产文本与视觉双料头名,更是将Coding等细分能... AI 前沿动态# LMSYS# Qwen3.7# 国产生态 2个月前340
做三明治、擦桌子样样精通!登顶RoboChallenge的星动纪元Era0,如何用细节终结“PPT机器人”时代? 星动纪元自研具身模型Era0登顶真机评测榜RoboChallenge,写三明治、擦桌子等任务惊艳业界,搭载该大脑的星动M7人形机器人已于中国邮政上岗,标志着具身智能正式从实验室走向商业批量交付时代。 AI 前沿动态# RoboChallenge# 人形机器人# 具身智能 2个月前340
AI不再“近视眼”:上交大&蚂蚁提出R2I蒸馏,单次推理实现细粒度感知,速度提升10倍 上海交通大学与蚂蚁集团联合提出Region-to-Image Distillation方法,让多模态大模型无需反复缩放即可实现细粒度视觉感知,性能超越Kimi-K2.5等大模型,速度提升10倍。 AI 前沿动态# AI视觉# ZwZ# 区域到图像蒸馏 2个月前340
独家|年利润数千万,睿尔曼智能获5亿元C轮融资,具身智能赛道首个盈利玩家! 睿尔曼智能完成5亿元C轮融资,2025年净利润数千万元,实现盈利。全栈自研四大核心部件,产品性能领先,年产能10万台,获CR L3认证,客户包括智元机器人等。 AI 前沿动态# 5亿元# C轮融资# 一体化关节模组 2个月前340
一个月烧掉130万美元Token!龙虾之父自曝账单,OpenAI全包 龙虾之父Peter Steinberger一个月消耗6030亿Token,费用高达130万美元却由OpenAI承担。揭秘其背后的自动化开发体系与Tokenmaxxing现象。 AI 前沿动态# AI费用# Codex# OpenAI 2个月前340
企业知识库效率翻倍?多模态RAG如何重写检索逻辑,破解三大核心瓶颈 多模态RAG将检索对象从文本扩展至PDF页面、图表、表格等,解决传统RAG维度灾难与信息丢失问题,显著提升企业知识库利用率与可信度。 AI 前沿动态# Gemini API File Search# 企业知识库# 向量检索 2个月前340
月烧940万元!龙虾之父的AI Agent团队烧掉了130万美元的token 龙虾之父Peter Steinberger晒出CodexBar截图:30天消耗6030亿token,费用130万美元,全部用于开发OpenClaw的多Agent团队,引发对AI成本与回报的讨论。 AI 前沿动态# Codex# OpenAI# OpenClaw 2个月前340