多模态大模型能理解视频笑点吗?v-HUB基准揭秘AI幽默理解的四大短板 上海交大等团队发布v-HUB基准,评测7款多模态大模型对无台词搞笑视频的理解力。研究发现模型严重依赖文字描述,难以从视频中直接捕捉动作、声音与反差,幽默解释仍存关键短板。 AI 前沿动态# ACL 2026# Gemini# GPT-4o 2个月前420
从独角兽到停服:小冰错失的三次技术浪潮与内部撕裂真相 估值20亿美金的AI明星小冰为何突然停服?创始人李笛独家复盘三次技术浪潮错过始末,以及股权博弈、资金矛盾如何将公司推向终点。 AI 前沿动态 2个月前420
3小时17人!2050学习节AGI for Science专场:青年学者激辩AI的物理边界与认识论革命 2050学习节AGI4Science专场汇聚17位青年学者,从核聚变、芯片设计到生物制造,探讨AI for Science的落地前沿、能力边界与未来走向,呈现一幅正在生长的科学地图。 AI 前沿动态 2个月前420
AI叙事新突破:复杂角色交互引擎生成「双重生」宫斗剧本,读者直呼上头 从一段帝后双重生宫斗故事中,解析最新AI叙事引擎如何保持多角色视角一致性与情节逻辑,为游戏和互动小说带来新可能。 AI 前沿动态 3个月前0420
当AI智能体“忘记”安全指令:Meta总监邮箱被清空,紧急拔网线自救 Meta AI安全总监Summer Yue将OpenClaw智能体接入工作邮箱,AI因上下文压缩丢失安全指令,疯狂删除数百封邮件。这起事故暴露了AI从对话转向行动时,可控性的脆弱一面。 AI 前沿动态 3个月前0420
腾讯WorkBuddy直面OpenClaw争议:自研架构、无开源束缚,重新定义AI代理安全范式 腾讯回应WorkBuddy争议:完全自研未使用OpenClaw源码,不受开源协议限制。产品采用半自动化设计规避安全风险,多产品并行构建生态,走场景化可控的AI代理新路。 AI 前沿动态 3个月前0420
告别会员广告绑架!这款高颜值 Material You 本地播放器才是极客听歌标配 GitHub上备受瞩目的开源工具PixelPlayer近日推出更新。该应用专为追求纯净无广告的本地听歌用户打造,深度融合安卓原生Material You动态取色美学。凭借强劲的Media3内核,支持F... AI 前沿动态# ExoPlayer# GitHub# Material You 2个月前410
打工人报销救星!开源免费的“票易合”让你彻底告别发票PDF排版地狱 GitHub上的开源工具“票易合”是一款专为财务报销与打工人设计的发票PDF合并排版利器。它支持Windows与macOS系统,提供1x1到10x10自由布局排版,并具备发票去重与批量命名功能,彻底解... AI 前沿动态# GitHub# PDF排版# 发票合并 2个月前410
告别视觉幻觉!首个多模态并行思考框架开源:以“宽度”破局,让VLM学会分头行动 视觉语言模型在长推理时易发生注意力漂移并产生幻觉。为此,最新研究提出首个并行思考框架Visual Para-Thinker,引入并行注意力与分段学习位置编码机制。实验显示该框架显著提升了多模态模型在视... AI 前沿动态# Visual Para-Thinker# 多模态大模型# 并行思考 2个月前410
AI制药的“反摩尔定律”困局:算力暴涨,新药产出为何下降?三位顶尖学者激辩四大破局路径 算力暴涨为何新药产出下降?三位教授从系统科学、数据鸿沟、高价值赛道和AI Agent等角度,揭示AI制药破局的关键路径,深度探讨后AlphaFold时代的机遇与挑战。 AI 前沿动态# AI agent# AI制药# AlphaFold 2个月前410