推理为什么总卡顿?前谷歌 TPU 架构师拆解:算力之外,显存带宽、KV Cache 与并发才是关键 前谷歌 TPU 架构师 Reiner Pope 解析大模型推理为何会卡顿:显存带宽、批处理、KV Cache、长上下文和 MoE 通信墙如何共同限制速度与成本。 AI 前沿动态 2个月前0500
腾讯Knot突袭:用自然语言驱动任务,国内大厂AI智能体大战一触即发 腾讯内部启动AI任务助手Knot试用,主打自然语言指令无缝转为可执行任务,与阿里千问、字节扣子竞逐AI下半场,行业全面转向可执行智能体。 AI 前沿动态 3个月前0500
独家:腾讯云AI业务架构大调整,CTO王慧星接管云产品三部 腾讯云内部沟通会披露AI业务调整:云产品三部汇报线改向CTO王慧星,吴运声新增负责企业中台产品部;算力训练平台转至IaaS团队。 AI 前沿动态# AI业务调整# IaaS# 云产品三部 2个月前490
CVPR 2026 世界模型路线图:从像素幻象走向物理法则的8项重磅突破 CVPR 2026世界模型方向涌现重磅成果。本文系统梳理4D几何建模、物理对齐、零样本相机控制、交互决策与统一评测等8项突破,揭示视频生成向世界模拟的深刻转变。 AI 前沿动态 2个月前490
告别Prompt工程!这款AI让“一句话生成专业级PPT”成为现实 实测胖鹅AI:一句大白话就能生成专业PPT和视频。揭秘其SOP核心机制,让AI适应人而非人适应AI。 AI 前沿动态 3个月前0490
从“大魏女将军”看AI角色扮演:复杂人设指令如何实现精细行为控制 从网络走红的“ds人设”指令出发,揭秘新一代AI如何扮演多维角色并严格遵循二十余条行为禁令,探讨其背后的人设构建与安全护栏技术。 AI 前沿动态 3个月前0490
豆包退票翻车之后:我们到底该不该相信一个太会哄人的AI? AI幻觉正在让用户为错误建议买单,豆包退票纠纷只是一个切口。本文梳理法律责任、机械欺骗与AI陪伴风险,提醒用户在票务、医疗、心理等高风险场景必须核验。 AI 前沿动态# AI幻觉# AI陪伴# Character.AI 2个月前480
让AI自己进化“外骨骼”!复旦联手北大开源AHE框架,刷爆榜单的底层技术长啥样? AHE自进化框架针对大模型Agent在长期工程中Harness难以手动调优的痛点,通过可观测性驱动,实现了端到端自动进化。复旦等团队实测表明,该方案助力GPT-5.4在基准测试上绝对提升7.3%,展现... AI 前沿动态# Agentic Harness# AHE框架# 复旦大学 2个月前480
AI Agent的“斯坦利时刻”:告别基准高分幻觉,直面职场执行鸿沟 Trainee-Bench通过模拟真实职场,从动态调度、主动探索、持续学习三维度评估AI Agent,结果显示顶尖模型成功率不足35%,并发任务下性能骤降,甚至出现“记吃不记打”的反常现象。 AI 前沿动态# AI agent# Trainee-Bench# 动态调度 2个月前480
只用双人数据训练,就能生成七人舞蹈动画!中科院计算所与上交大CVPR 2026新作颠覆多人物视频生成 中科院计算所与上海交大提出MultiAnimate框架,仅用双人数据训练即可生成多达七人的高一致性动画,解决多人交互中的身份混淆与空间错位问题,效果显著优于现有方法。 AI 前沿动态# CVPR 2026# 上海交大# 人物掩码 2个月前480