GLM-5大规模推理踩坑实录:智谱如何揪出Scaling路上的隐形Bug
智谱公开GLM-5大规模Coding Agent推理中遇到的乱码、复读等异常,深入分析KV Cache复用冲突与read-before-ready问题,并提出同步机制与LayerSplit优化方案,提...
1930年知识模型微调后竟能写代码?Talkie-1930-13b在SWE-bench上实现4.5%通过率
知识截止于1930年的talkie-1930-13b模型经过微调后,在SWE-bench上实现4.5% pass@1,并成功修复xarray库bug,引发对智能本质的讨论。
440MB离线翻译模型超越谷歌?腾讯混元Hy-MT1.5开源,手机秒变翻译神器!
腾讯混元开源Hy-MT1.5翻译模型,极致量化至440MB,离线手机运行,翻译质量超越谷歌,支持33种语言。
一支15人华人团队,如何用“会推理”的图像模型杀进全球前三?
Luma AI发布Uni-1.1 API,凭推理与生成统一架构冲进Arena.ai全球第三,价格仅为同类一半。由宋佳铭、沈博魁领衔的15人华人团队打造,已获Publicis、Adidas等客户采用。
Anthropic颠覆AI对齐:中训练让模型失准率从68%暴跌至5%
Anthropic提出模型规范中训练(MSM),在预训练后插入价值观教育,实验证明可将智能体失准率从68%降至5%,同时精简微调数据40-60倍。
低提示词革命!00后团队打造胖鹅AI:一句话生成视频、网页看板,重新定义AI交互
00后团队打造胖鹅AI,以低提示词理念降低AI使用门槛。无需学习Prompt工程,一句话即可生成视频、可交互数据看板等,背后是垂直SOP体系。
一句话需求+百元预算,Vidu Claw如何用AI生成百万级广告片?
Vidu Claw通过一句需求+百元预算即可生成高质量广告片,打破传统视频制作高成本长周期瓶颈。Video Plan权益计划重构创作成本结构,支持全端创作与第三方集成。
苹果官方App意外泄露内部AI秘密:Claude Code真的可靠吗?
苹果Apple Support应用意外打包Claude.md文件,暴露内部AI客服架构,引发对AI编码安全性与信任度的讨论。
算力不再是瓶颈!GS-Playground开源:首个高吞吐并行仿真+高保真3DGS渲染框架,实现具身智能零微调迁移
清华大学AIR联合多家机构开源GS-Playground框架,首次实现高吞吐并行物理仿真与高保真批量3DGS渲染的深度融合,支持自动化Real2Sim工作流和零微调真机迁移,为视觉驱动机器人学习提供强...
15分钟!陶哲轩用Claude Code秒改审稿意见,还揪出审稿人拼写错误
数学家陶哲轩将论文审稿报告喂给Claude Code,15分钟完成修改,还发现审稿人拼写错误。AI+人正成为数学界新趋势。