在NVIDIA GB300 NVL72上以可配置推理服务Qwen3.8-2.4T-A95B,一款2.4T参数模型
Serve Qwen3.8-2.4T-A95B, a 2.4T-Parameter Model, with Configurable Reasoning on NVIDIA GB300 NVL72
摘要
阿里巴巴发布Qwen3.8-2.4T-A95B(Qwen3.8-Max)开放权重,为该司最大开放权重模型。模型总参数2.4万亿,每token激活950亿参数,采用细粒度混合专家(MoE)架构,结合全注意力和线性注意力,上下文窗口未明确。该模型为开放生态带来接近前沿的能力。
阿里巴巴发布了Qwen3.8-2.4T-A95B(Qwen3.8-Max)的开放权重,这是其最大的开放权重模型,为开放生态系统带来了接近前沿的能力。该模型总参数达2.4万亿,每个token激活950亿参数。它采用细粒度混合专家(MoE)架构,结合了全注意力和线性注意力,上下文窗口为……来源
译自 NVIDIA · Developer 博客 · 录于 二〇二六年八月十二日