除夕炸场!阿里千问3.5 Plus发布:3970亿参数仅激活170亿,性能超越GPT-5.2,API价格仅为Gemini的1/18
导语:阿里除夕发布千问3.5 Plus,性能超越GPT-5.2,API价格仅为Gemini的1/18。

2025年除夕当天,阿里开源新一代大模型Qwen3.5-Plus,性能媲美Gemini-3-pro、GPT-5.2等顶级闭源模型,一举登顶全球最强开源模型宝座。这款模型在架构上全面创新,是阿里首款原生多模态模型,总参数达3970亿,实际激活仅170亿,性能却超越万亿参数的Qwen3-Max;部署显存占用降低60%,最大吞吐量提升19倍,真正实现“以小胜大”。
性能与效率大幅提升
过去大模型行业陷入“参数崇拜”,从千亿到万亿,部署门槛高、推理成本高。Qwen3.5-Plus打破了这一思路,采用原生多模态预训练范式,技术架构创新体现在四大维度:
1. 注意力机制革新
传统Transformer对每个词做全量计算,算力随文本长度指数增长。Qwen3.5-Plus引入混合注意力机制,自动识别关键信息精读、非关键快读,降低长文本处理成本同时保证精度。
2. 极致稀疏MoE架构
传统稠密模型每次推理激活全部参数;Qwen3.5-Plus采用MoE架构,3970亿总参数中仅激活不到5%(170亿),根本解决算力浪费。
3. 原生多Token预测
传统模型逐字生成,效率低;Qwen3.5-Plus在训练时学会“预判”,能同时规划多个词甚至一整句话输出,长文本生成、代码补全、多轮对话响应速度近乎翻倍。
4. 系统级训练稳定性优化
阿里千问团队入选NeurIPS2025最佳论文的注意力门控机制被应用,在256K超长上下文下推理吞吐量最大提升19倍。
在多模态训练方面,Qwen3.5从预训练第一天起就在文本和视觉混合数据上联合学习,训练吞吐量几乎100%持平纯文本基座模型,激活内存减少约50%,训练提速10%。在推理阶段,MMLU-Pro认知能力评测中拿下87.8分(超越GPT5.2),博士级难题GPQA斩获88.4分(高于Claude 4.5),指令遵循IFBench以76.5分刷新纪录,通用Agent评测BFCL-V4、搜索Agent评测Browsecomp等均超越Gemini-3-Pro。
人人都能用的AI:极致性价比
高昂API成本是AI落地最大障碍。阿里云百炼上Qwen3.5-Plus API每百万Token输入仅0.8元,仅为Gemini-3-pro的1/18。这种定价底气来自模型、芯片和云的协同创新:平头哥真武芯片针对MoE架构优化,打破性能、效率和成本的不可能三角。同时,千问3.5面向全球开源,开发者可在魔搭社区和HuggingFace免费下载部署,阿里还将陆续开源不同尺寸、不同功能的Qwen3.5系列模型。千问系列已开源400多个模型,衍生模型超20万,全球下载量突破10亿次。
据Omdia数据,2025年上半年中国AI云市场规模223亿元,阿里云占比35.8%,超过第二到第四名总和;2025年阿里云在中国云市场份额从33%提升至36%,领先优势扩大。