• Home
  • Industry News
  • Innovation Hub

    Membership

    Innovation Cases

  • Expert Voices

    Expert Voices

  • Community
  • Partnership
  • 

    Search

  • 

    Login

  • 

    Collaboration

  • Home
  • Industry News
  • Innovation Hub
    • Membership
    • Innovation Cases
  • Expert Voices
  • Community
  • Partnership
  • 

    Search

  • 

    Login

  • 

    Collaboration

阿里开源Qwen3-Next架构:800亿参数仅激活30亿,成本暴降90%
  • Information Technology
作者:安安
 时间:2025-09-16 14:54:01

字节跳动数字人发布(1)

阿里通义千问的新架构在长文本推理上实现了10倍吞吐提升,仅用3.2%的计算资源就能达到此前旗舰模型相当的性能,开启AI模型“小参数大能量”时代。9月12日,阿里巴巴通义实验室正式推出新一代基础模型架构Qwen3-Next,并开源了基于该架构的Qwen3-Next-80B-A3B系列模型。这一创新架构通过混合注意力机制和高稀疏度MoE结构四大核心改进,实现了训练成本降低超90%和长文本推理吞吐量提升10倍的突破。

 


01 架构创新:四大技术突破重塑效率标杆

Qwen3-Next并非对原有模型的简单优化,而是针对大模型在上下文长度扩展和参数量扩展两大趋势的重新设计。新架构包含四项核心创新:混合注意力机制、高稀疏度MoE结构、训练稳定性优化以及多token预测机制。其中最引人注目的是混合注意力机制的设计。该机制采用75%的Gated DeltaNet线性注意力与25%的标准注意力相结合的策略。这种组合解决了单纯使用线性注意力或标准注意力的局限——前者在长序列建模上效率高但召回能力弱,后者计算开销大、推理不友好。

 


02 效率突破:训练成本降九成,推理速度升十倍

Qwen3-Next-80B-A3B模型总参数达800亿,但每次推理仅激活约30亿参数,激活比达到惊人的1:50。这一设计带来显著的效率提升。训练成本较密集模型Qwen3-32B降低超90%,长文本推理吞吐量提升10倍以上。具体而言,在4k tokens的上下文长度下,预填充阶段吞吐量接近Qwen3-32B模型的7倍;当上下文长度超过32k时,吞吐提升达到10倍以上。解码阶段同样表现优异——在4k上下文下实现近4倍吞吐提升,长上下文场景保持10倍优势。

 


03 性能表现:小参数媲美旗舰大模型

尽管激活参数大幅减少,Qwen3-Next的性能却令人印象深刻。测试数据显示,Base模型性能已接近Qwen3-32B密集模型的水平。指令模型(Instruct)在多项基准测试中达到与Qwen3-235B-A22B-Instruct-2507相当的水平。思维模型(Thinking)更是在部分复杂推理任务上超越Gemini-2.5-Flash-Thinking。在RULER基准测试的256k范围内,Qwen3-Next甚至击败了层数更多的Qwen3-235B-A22B-Instruct-2507。

 


04 技术细节:混合注意力与极致稀疏MoE

Qwen3-Next的混合注意力机制通过系统实验验证,Gated DeltaNet相比常用的滑动窗口注意力和Mamba2有更强的上下文学习能力。在保留的标准注意力中,团队引入了多项增强设计:输出门控机制缓解注意力中的低秩问题;将单个注意力头维度从128扩展至256;仅对注意力头前25%的位置维度添加旋转位置编码。MoE架构方面,Qwen3-Next从Qwen3 MoE的128个总专家和8个路由专家,扩展到了512总专家,10路由专家与1共享专家的组合。训练稳定性优化包括采用Zero-Centered RMSNorm并对norm weight施加weight decay,以及初始化时归一化MoE router参数。

 


05 多Token预测:推理效率的额外提升

Qwen3-Next引入了原生Multi-Token Prediction(MTP)机制,得到了Speculative Decoding接受率较高的MTP模块,提升了主干本身的综合性能。团队特别优化了MTP多步推理性能,通过训练推理一致的多步训练,进一步提高了实用场景下的Speculative Decoding接受率。这一设计受到开发者社区的高度评价,被认为是在保持模型性能的同时,为降低训练推理成本提供了创新解决方案。

 


06 开源生态:开发者可便捷获取使用

阿里通义已经将Qwen3-Next-80B-A3B系列模型权重在Hugging Face平台以Apache-2.0协议开源,支持通过Transformers、SGLang、vLLM等主流框架部署。开发者还可通过Qwen Chat免费体验或调用阿里云百炼平台API服务。第三方平台OpenRouter也已完成适配上线,方便开发者便捷调用相关能力。



沙利文数据显示,中国企业级大模型调用量2025年上半年日均较2024年底增长363%,阿里通义占比17.7%位列第一。通义千问衍生模型数已超17万,稳坐全球第一开源模型。Qwen3-Next的成功研发标志着AI模型发展从单纯追求参数规模转向效率与性能并重的新阶段。


阿里通义实验室透露,后续将持续优化架构并推进Qwen3.5研发,同时加快文生图、语音识别等多领域模型的开源进程。随着Qwen3-Next的开源,开发者社区获得了更强有力且经济高效的工具,这将进一步加速AI技术在各行业的普及和应用深化。

分享到:
0
相关文章
  • 从数据到AI,一条新的价值链正在成型 | 200+数智先锋共同见证第五届中国数据×AI价值峰会在京解码新纪元

     2026-08-24

  • Sam Altman’s Year-Old AI Research Intern Flag Has Come True Early: OpenAI’s “AI Research Interns” Are Now on the Job, With 3.1 AI Agents Working Behind Every Researcher

     2026-09-08

  • 私域运营”赋能银行业务“最后一公里”!

     2022-11-02

  • 通义千问Qwen3.5开源家族再扩容,三款新模型上线并推出托管服务

     2026-02-26

  • 营收78亿、亏损收窄、AI烧掉158亿:SpaceX首份财报撕出两条极端曲线

     2026-08-05

  • 蚂蚁集团发布万亿参数模型Ling-1T,开启高效AI推理新纪元

     2025-10-10

热门标签
  • 零售快消
  • CDIE
  • 数字化转型
  • 新零售
最新快讯
  • 

    OpenAI Codex全面攻占Windows,手机远程接管PC,7x24小时“数字员工”来了

    • Information Technology
  • 

    英特尔宣战英伟达:AI算力,不是只有GPU一条路

    • AI
  • 

    OpenAI亲自下场造机器人:时隔六年,世界模拟能力成为最大底牌

    • Information Technology
    • AI
  • 

    马斯克AI烧钱游戏:xAI去年巨亏64亿美元,靠Starlink养家,还要把算力送上天

    • Information Technology
    • AI
  • 

    8小时狂揽15K美金!Claude Code屠榜黑客松,开源神器爆15万星

    • AI
    • 新零售
查看更多 
最新入驻企业
  • 魔镜洞察

    AI市场研究与消费者洞察服务商

  • 拜特科技

    中国领先的资金管理软件服务商

  • 奇墨科技

    AI落地解决方案及数字化创新服务提供商

  • 致远互联

    一家集产品的设计、研发、销售及服务为一体高新技术企业

  • 滴普科技

    滴普科技是国内领先的全场景数据智能服务商

查看更多 
  • About Dot Connector

    About Us

    Join as Expert

    Join as Enterprise

    Media Partnerships

    Contact Us

  • Quick Links

    Industry News

    Enterprise Services

    Expert Voices

    Community

    Partnership

  • Popular Picks

    Latest Events

    Featured Companies

    Join as Enterprise

    Featured Experts

    Trending News

  • 关注我们

    扫码添加客服微信,
    享受1V1专属服务

    免费领取研究报告,
    发送名片申请入群
版权所有 © 2021 技术加 沪ICP备2022026615号-1 | 沪公网安备11010502036099号