阿里开源2.4万亿参数大模型Qwen3.8-2.4T-A95B,性能比肩Fable 5
创始人
2026-08-15 08:26:07

8月13日,阿里千问大模型团队正式开放 Qwen3.8-2.4T-A95B 模型权重,这是千问首次开源 Qwen-Max 级别旗舰模型。该模型拥有 2.4 万亿总参数,采用稀疏激活的混合专家架构,性能比肩行业顶级模型 Fable 5。

此次开源将原本仅通过商业 API 访问的顶级大模型推向开放生态,标志着千问开源路线的一次重要升级。Qwen3.8-2.4T-A95B 面向复杂推理与长时间运行的 Agent 任务设计,权重已在 Hugging Face 与 ModelScope 同步上线,开发者可基于自身基础设施进行部署与二次开发。

架构解析:2.4T 总参数与 95B 激活参数

Qwen3.8-2.4T-A95B 的命名直接体现了其结构特征:"2.4T"指模型总参数规模,"A95B"表示每个 Token 实际激活约 95B 参数。模型采用细粒度混合专家(MoE)架构,包含 512 个专家,推理时每次激活其中 11 个,并在 92 层混合注意力堆栈中结合全注意力与线性注意力,以平衡长序列处理能力与计算成本。

  • 总参数:2.4 万亿

  • 每 Token 激活参数:约 95B

  • 架构:细粒度 MoE,512 专家、每次激活 11 个

  • 原生上下文:262,144 Token,可扩展至约 100 万 Token

  • 最大输出长度:128K Token

超长上下文与推理表现

在上下文能力上,Qwen3.8-2.4T-A95B 原生支持 262,144 Token 的上下文窗口,并可通过扩展手段提升至约 100 万 Token,为长文档理解、多轮复杂任务与 Agent 工作流提供了充足空间。模型在编码、专业任务、研究与长程智能体任务等方面均较前代显著提升,官方口径下性能可比肩 Fable 5 等顶级模型。

需要说明的是,本次开源权重版本为纯文本模型,不支持视觉等多模态输入,且思考模式强制开启、每条回复都会先生成思维链。若需要视觉输入、非思考模式等增强能力,可选用其官方商用版本 Qwen3.8-Max。

开源与商用双轨:Qwen3.8-Max 的差异化定位

Qwen3.8-Max 是基于 Qwen3.8-2.4T-A95B 的官方版本,于 8 月 3 日发布。相比开源权重版,Qwen3.8-Max 额外提供视觉输入功能、无需思考即可使用的非思考模式、默认 100 万 Token 上下文处理,以及内置官方工具,定位更为完整的产品化能力。

开源版本模型权重以 Transformers 格式提供,兼容 vLLM、SGLang、TokenSpeed 等主流推理引擎,官方还同步发布了细粒度 FP8 量化版本。NVIDIA 已提供在 GB300 NVL72 平台上部署该模型的服务指南,面向需要数据中心级算力的企业用户。对于不便自建基础设施的开发者,可通过千问官方云服务调用,输入价格约每百万 Token 2 美元、输出每百万 Token 6 美元。

展望:开源生态再上台阶

Qwen3.8-2.4T-A95B 的发布,将"闭源顶级模型"与"开源生态"之间的距离进一步拉近。对于科研机构与企业开发者而言,能够自主部署万亿参数级模型意味着更多可控的推理与微调空间;而对于整个大模型行业,顶尖模型的开源也预示着竞争重心正从参数规模向工程化能力与生态协同转移。

相关内容

热门资讯

哪些因素影响公共建筑线性地漏的... 过滤筛分行业发展背景与需求升级 近年来,随着石化、水处理、淀粉加工、建筑等多个领域产业升级步伐加快...
怎么挑选适配多场景的线性地漏 过滤筛分行业发展现状 近年来国内工业生产、市政民生等领域对过滤、分离、排水类构件的性能要求持续提升,...
瑞尔特获得外观设计专利授权:“... 证券之星消息,根据天眼查APP数据显示瑞尔特(002790)新获得一项外观设计专利授权,专利名为“地...
跻身十大品牌,富莎何以站上淋浴... 在家装消费升级的浪潮下,淋浴房早已不再只是简单的干湿分离隔断,而是衡量卫浴空间质感的核心单品。作为行...
进口vs国产淋浴房|中国智造如... 提到淋浴房,很多人在选购时会纠结一个问题:进口品牌和国产品牌,到底选哪个?过去很长一段时间里,进口意...