多模态大模型能理解视频笑点吗?v-HUB基准揭秘AI幽默理解的四大短板 上海交大等团队发布v-HUB基准,评测7款多模态大模型对无台词搞笑视频的理解力。研究发现模型严重依赖文字描述,难以从视频中直接捕捉动作、声音与反差,幽默解释仍存关键短板。 AI 前沿动态# ACL 2026# Gemini# GPT-4o 2个月前420
零成本白嫖主流大模型!免注册免信用卡的免费 LLM API Keys 开源分享项目 GitHub开源的免费大模型API Key分享服务让你免注册、免信用卡即可快速接入GPT-5.5、Claude与DeepSeek等主流模型。项目不仅完美兼容OpenAI SDK,还提供单Key最高百刀... AI 前沿动态# Claude3# GitHub# GPT-4o 2个月前330
从GPT-4o到原生音画视频:九大顶尖研究机构联合拆解音视频大模型演进图谱 音视频大模型长期面临任务割裂与评测缺失痛点。NUS联合牛津等九大机构推出首份系统大模型航空图,从理解、创造与交互三维度重构主流任务,揭示了从级联式语音向天生融合多模态协同演化的产业路径,具有极高架构参... AI 前沿动态# Awesome-AVI# GPT-4o# 具身智能 2个月前290