产品信号

Alibaba将Qwen3.8-Max推入默认API

Alibaba Cloud现将qwen3.8-max列为默认启用思考的hybrid-thinking模型;此前仅有Token Plan独家的Qwen3.8-Max-Preview。

Alibaba正把Qwen3.8-Max从受限预览推进至默认API产品层。Alibaba Cloud当前文档将qwen3.8-max列为默认启用思考的hybrid-thinking模型,而此前的Qwen3.8-Max-Preview仅限Token Plan使用。这一变化使其不再只是面向订阅用户的预览型号,而成为Alibaba面向开发者部署旗舰能力的明确产品信号。

旗舰模型跨出受限预览

Alibaba Cloud的模型文档显示,qwen3.8-max现以默认开启思考模式的hybrid-thinking模型提供;同一文档仍将qwen3.8-max-preview标作Token Plan限定的thinking-only版本。官方在7月曾将预览版称为Qwen家族最新、最强模型,覆盖开发、数据分析、办公和视觉理解等任务。两份产品材料共同表明,Qwen3.8-Max的状态已从限定预览转为可被开发者在API工作流中调用的正式型号。

长任务定位需要产品化承接

The Decoder报道称,Qwen3.8-Max拥有2.4万亿参数,定位于可持续处理数日复杂任务,并计划在下周发布权重。若这一计划落地,API可用性与开放权重将形成两条分发路径:企业可以先以托管模型接入,开发者也可围绕权重进行本地化部署和定制。Alibaba此前对Qwen3.7-Max的内部测试称,其可连续运行35小时、进行逾1,000次工具调用;这说明该公司已将长时程代理执行作为旗舰模型迭代的核心叙事。

正式命名不等于性能领先

此次变化的关键不在于参数规模本身,而在于Alibaba是否能把长任务能力转化为稳定、可复用的开发者工作流。其前代Qwen3.7-Max的长时程结果来自厂商内部测试,不能直接证明Qwen3.8-Max的表现。更重要的反证来自Artificial Analysis对更早Qwen3-Max-Thinking的评估:其综合指数和代理任务指标均落后于部分同业模型。因此,Qwen3.8-Max的正式产品状态已清晰,但其相对领先位置仍须依赖外部评测和真实部署结果确认。

接下来关注什么

下一步可观察三类证据:Alibaba是否按报道发布权重及完整模型卡;API文档是否披露价格、上下文长度、工具调用和地区可用范围;以及独立评测是否在长时程代理、代码和推理任务上将Qwen3.8-Max置于前列。若权重未发布、能力主张缺少可复现实验,正式API化对竞争格局的含义将明显减弱。

信源