阿里巴巴将于周三发布 Qwen 3.8-Flash-Next,这是一个拥有 1250 亿个参数的模型,每个代币仅激活 60 亿个。 Qwen 团队将其视为下一代 Qwen 4 架构的预览,而不是成品旗舰产品。
目前还没有关于该模型的官方信息,但根据传言,它很可能是一个混合专家系统,这种设计将网络分成许多专门的子模型,并只点亮每个任务的相关子模型。因此,运行一个 1250 亿个参数的模型所需的计算费用相当于只有 60 亿个参数的模型。

参数基本上是模型可以调整的所有刻度盘。参数越多,模型的能力就越强,所需的计算能力也就越强。专家的混合使得极其强大的模型能够仅激活提供最佳输出所需的内容,而不会浪费资源。
Qwen 3.8 Flash Next 将于明天发布。 125B 参数+51B N-gram 和 6B 活动。它基于下一代Qwen 4架构。
《Qwen 4》即将推出 https://t.co/xduZNdKnKU pic.twitter.com/rAcBZlNwKs
— AiBattle (@AiBattle_) 2026 年 8 月 25 日
阿里巴巴的 Qwen 团队确实将该模型描述为多模式,并基于即将推出的 Qwen 4 架构构建,并表示已发布了早期版本,以便开发人员可以为整个系列做好准备。
为什么“3.8”不是新闻
阿里巴巴已经发布了预告片,但团队称其为预览版。该计划是在 Qwen 4 全面推出之前立即发布架构改进。 Hugging Face(权重也存在于此)也将其描述为“Qwen 4 架构的预览”。
硬基准尚未落地。 Qwen尚未公布与自己的Qwen 3系列或西方竞争对手的并列分数,因此1250亿和60亿的参数数字尚未得到验证,我们只能推测其性能。
中国的公开重量级节奏一直是不懈的。一个神秘的免费模型 Ox Alpha 最近在某些编码基准测试中击败了 Anthropic 的 Fable,但其背后并没有任何已知的构建者。阿里巴巴、DeepSeek 和 Moonshot 都提供了任何人都可以下载、微调和运行的权重。
开放权重让开发人员无需将数据发送到封闭的 API 即可进行构建,并且降低了托管模型的成本。这就是为什么具有 60 亿个活动参数的开放式 1250 亿参数模型很重要:它为商用硬件提供了接近前沿的功能。
但我们必须等待数字。截至撰写本文时,Qwen 尚未发布该版本的基准分数。