产品信号

Qwen开放2.4万亿参数Max权重

Qwen已公开Qwen3.8-2.4T-A95B权重,将此前受限于Token Plan等托管渠道的Qwen3.8-Max推进为可下载、可本地部署的开放模型。

Qwen已将其最大的Qwen3.8-Max从受限托管预览推进至公开权重分发。官方仓库现提供Qwen3.8-2.4T-A95B下载,而Alibaba此前将2.4万亿参数的Qwen3.8-Max-Preview限制在Token Plan、Qoder和QoderWork等渠道。这一变化使模型竞争从API选择扩展到部署权和基础设施控制权。

最大Qwen模型进入开放分发

Qwen官方模型仓库已提供Qwen3.8-2.4T-A95B的公开权重和模型卡,确认该具体型号可供下载,并披露架构规格与使用限制。NVIDIA将其称为Qwen3.8-Max、2.4万亿参数模型,并说明其可在GB300 NVL72上以可配置推理方式部署。此前市场可接触的是托管的Qwen3.8-Max-Preview;现在具备相应硬件和工程能力的用户可自行评估和运行该模型。

开放权重改变的是部署控制权

Alibaba在7月说明,Qwen3.8-Max-Preview当时仅通过Token Plan、Qoder和QoderWork提供,同时承诺Max将开放权重。托管访问让模型提供商控制价格、排队、区域和产品接口;公开权重则让企业和云服务商能够自主决定推理栈、量化策略、数据边界与资源调度。对于超大参数模型,这种选择不意味着低成本,而是把成本结构从按调用付费转为硬件、运维和吞吐优化的组合。

高端硬件成为开放模型的现实约束

NVIDIA给出的GB300 NVL72部署路径表明,运行此类模型的门槛仍主要由集群资源和系统优化决定。开放权重扩大了可用范围,却不自动扩大可负担范围。其更直接的产业意义在于,云服务商、主权算力项目和拥有高密度GPU集群的企业可以用同一模型建立差异化服务,而不必完全依赖原厂托管端点。

接下来关注什么

下一步可观察的证据包括:Qwen是否发布正式性能评测、推荐硬件配置和更完整的商用部署文档;主要云平台是否上线托管版本;以及独立部署者能否披露在不同量化、集群规模和任务类型下的吞吐、成本与可靠性结果。这些数据将检验公开权重能否转化为广泛采用。

信源