阿里 Qwen 3.8 2.4T 参数预览上线,开源权重「soon」成悬念

前言

2026 年 7 月 19 日,上海 WAIC(世界人工智能大会)期间,阿里巴巴 Qwen 团队在 X 上宣布 Qwen3.8-Max-Preview:总参数量 2.4 万亿,多模态输入,宣称能力「仅次于 Claude Fable 5」,并承诺将「soon」开放权重。预览端点已可通过 Token Plan、Qoder、QoderWork 使用。

与 Kimi K3 在 7 月 16 日发布时附带 benchmark 表格、定价和 7 月 27 日放权日期不同,Qwen 3.8 的发布几乎只有一条推文:没有 benchmark、没有 model card、没有正式 API 按 token 计价。开发者社区很快把讨论焦点从「模型强不强」转向一个更具体的问题:「soon」到底算不算日期?

本文基于 Qwen 官方公告、Qwen Cloud 文档及多家媒体交叉核实,梳理目前已确认的事实、仍悬而未决的指标,以及普通开发者应如何理性试用这一预览版。

7 月 19 日:WAIC 上的「预览」而非正式发布

根据 Qwen 官方 X 帖文及 Bloomberg、Quartz 等媒体报道,Qwen3.8-Max-Preview 于 2026 年 7 月 19 日(周日) 对外公布,发布场景与 WAIC 2026 时间窗口重合。需要强调的是:当前上线的是 预览端点,不是最终生产版本,更不是可下载的 open-weight 检查点。

Qwen Cloud 文档写明,预览期间模型会持续迭代,后续可能被下线或由正式版替代。因此,今天跑出来的结果,下周未必能复现——这在评估 frontier 模型时是一个硬约束。

官方给出的产品标识为:

qwen3.8-max-preview

接入时务必使用完整 model ID,避免与旧款 Qwen3-8B(80 亿参数小模型)混淆。Qwen3.8 是新的代际命名,2.4T 是其旗舰预览规格。

2.4T MoE 与多模态:已确认与未披露

已核实信息

项目 当前状态
总参数量 2.4 万亿(Qwen 官方口径)
架构 稀疏 Mixture-of-Experts(MoE),媒体与第三方综述一致引用
多模态 支持文本、图像、视频、文档输入(官方与 GIGAZINE、TechTimes 等报道一致)
预览接入 Token Plan、Qoder、QoderWork
开放权重 承诺「soon」,无日期、无许可证、无 Hugging Face 仓库

Qwen 称这是 Qwen 家族中首个总参数超过 1T 且具备多模态能力的旗舰预览,在规模上确实跨了一个台阶。

仍未公开的关键指标

以下信息截至 2026 年 7 月 29 日,Qwen 尚未在正式 model card 或技术报告中披露

  1. 每 token 激活参数量(active parameters)——决定推理成本与 MoE 实际算力消耗;
  2. 完整 benchmark 表格与评测方法论
  3. 最终 open-weight 许可证(Apache 2.0 还是 Qwen 研究许可等);
  4. 标准 API 按百万 token 定价(预览期走 Credits 订阅,见下文)。

第三方文档(如 Qwen Cloud Codex 集成指南)列出了部分集成层参数:上下文窗口约 983,616 tokens、最大输出 131,072 tokens、推理模式默认 xhigh 且不可关闭。这些属于接入文档中的集成规格,不能替代正式 model card,但比坊间「约 1M context」的二手说法更可靠。

「仅次于 Fable 5」:一句定位,零张表格

Qwen 原帖中的英文表述为:compatible to leading frontier AI models, second only to Fable 5。多家媒体(Quartz、TechTimes、GIGAZINE)均指出:公告未附带任何 benchmark 分数、评测配置或复现脚本

对比前代 Qwen3.7-Max(2026 年 5 月):当时 Alibaba 发布了较完整的技术材料,例如在 Artificial Analysis Intelligence Index 上给出 56.6 分等指标。而 Qwen3.7 本身未开放权重,至少还有数据可看。

Qwen3.8 则连这一层都省了——在 LMArena 等第三方榜单上,截至发布当周也没有 Qwen3.8 的独立排名条目;Claude Fable 5 仍居榜首,前代 Qwen3.7-Max 排名明显靠后。因此:

「全球第二」目前是 厂商自我定位,不是可复现的评测结论。

独立测试已有零星出现(如部分博主对 StackPerf 等任务的 matched test),但样本量小、且预览端点本身在变,不能当作官方 benchmark 的替代

「soon」是不是日期:开源悬念从哪来

这是本次发布在中文开发者社区里最火的分歧点。

Qwen 历史上的「开放」与「封闭」

核实 Qwen 近几代旗舰策略,时间线大致如下:

代际 时间 权重策略 发布材料完整度
Qwen3 及更早旗舰 2026 年前 多数提供可下载权重,多 Apache 2.0 较完整
Qwen3.6-Max-Preview 2026-04-20 首个封闭旗舰,仅 API 有 benchmark、定价
Qwen3.7-Max 2026-05 封闭,未承诺放权 有技术文档与指标
Qwen3.8-Max-Preview 2026-07-19 预览 API + 承诺 open-weight「soon」 无 benchmark、无日期

Qwen3.6、3.7 从未承诺过 Max 旗舰开源;Qwen3.8 则是 closed-preview 时代里首次重新提起 open-weight 叙事的 Max 级模型。社区因此既期待又警惕:words 回来了,calendar 没有。

为什么「soon」引发争论

AI 评论者 Julien Simon 将 Kimi K3 与 Qwen 3.8 的发布差异概括为 「dated gap vs undated gap」

  • K3:有 benchmark、有 $15/M output tokens 定价、权重承诺 7 月 27 日——到期未交付是可证伪事件;
  • Qwen 3.8:同样说 open-weight soon,但没有截止日期——「soon」只能漂移,无法被「证伪」。

对开发者而言,这意味着:

  1. 不能把「soon」当成隐含的发布日期做排期;
  2. 在 Hugging Face 出现带 license 文件的官方仓库之前,不宜称其为开源模型
  3. 即便未来放权,2.4T 总参数量在 4-bit 量化下也约需 1.2TB 级显存(TechTimes 估算),多节点或更激进量化才现实——active 参数未披露前,自托管成本仍无法精算。

背景:K3 发布三天后的「同周叙事」

时间线值得单独记一笔:Kimi K3 于 7 月 16 日发布,Qwen 3.8 于 7 月 19 日跟进。K3 当时被多家媒体称为中国厂商迄今定价最高的 frontier 模型之一(output 约 $15/百万 token),并给出 7 月 27 日 open-weight 节点。

Bloomberg 报道指出,K3 发布曾扰动全球科技股情绪;Qwen 3.8 公告后,阿里股价在下一个交易日一度上涨约 5.4%(Quartz 数据)。另有公开文件显示,阿里巴巴曾以约 8 亿美元取得 Moonshot(Kimi 母公司)约 36% 股权(2024 财年 20-F 报表,后续轮次或已稀释)。两家之间的竞合关系,为「同周双 flagship 叙事」提供了资本市场视角,但不改变技术评估应以可复现证据为准这一基本原则。

如何试用 Qwen3.8-Max-Preview

若要在可控前提下体验预览版,可按以下路径操作。

1. Token Plan 订阅(个人开发者主路径)

Qwen Cloud Token Plan Individual 当前促销档(第三方整理,以官网为准):

档位 促销月费 5 小时 Credits 上限 7 天 Credits 上限
Lite $6 700 2,500
Standard $18 3,000 10,000
Pro $68 12,000 40,000

预览期模型消耗约为标准价的 1/10;部分时段(UTC+8 22:00–08:00)可低至 1/50。注意:这是 Credits 制,不是已公布的 Qwen 3.8 正式 API 单价。

2. Qoder / QoderWork

  • Qoder:面向代码仓库与软件工程场景;
  • QoderWork:面向文档、表格等知识工作流。

二者与 Token Plan 共用预览额度逻辑,适合不想自建 Agent .harness 的开发者。

3. 第三方 Agent 工具接入

Qwen Cloud 文档列出可与 Token Plan 联动的工具,包括 Codex、Claude Code、Cursor、OpenCode、Cline 等。接入要点:

  1. 使用 API Key 时选择模型 ID qwen3.8-max-preview
  2. 记录测试日期与 reasoning level(默认 xhigh,可选 low / high / xhigh);
  3. 对比评测时固定 prompt、工具权限与仓库快照;
  4. 统计的不只是答案质量,还有 Credits 消耗、延迟、重试次数——推理常开会让同 prompt 成本波动很大。

4. 集成层已知限制(Codex 文档)

  • 输入:文本 + 图像(视频/文档能力以官方最新文档为准);
  • Parallel tool calls:当前 metadata 标注为不支持;
  • 内置工具:网页搜索、代码解释器、爬虫、以图搜图、文生图搜索等(Harness tools)。

开发者评估清单:预览可以测,不宜押生产

结合上文核实结果,建议在技术选型或公众号科普时采用下面这套「分级引用」规则:

  1. 可引用为事实:7 月 19 日发布、2.4T 总参数、MoE、多模态、三端预览、qwen3.8-max-preview ID、承诺 open-weight soon;
  2. 应标注为厂商主张:「仅次于 Fable 5」「frontier 级能力」;
  3. 应标注为待定:放权日期、许可证、active 参数、正式 API 定价、稳定 model behavior;
  4. 暂不宜写进 SLA:任何依赖固定行为的线上业务。

若你正在 Kimi K3(7 月 27 日权重节点)与 Qwen 3.8 之间做选型,7 月底是一个 natural checkpoint:一边是有日期的权重承诺,一边是仍无日历的「soon」。有日期的 claim 可以被验证;没有日期的 claim 只能被等待。

结语

Qwen3.8-Max-Preview 不是空穴来风——2.4T 多模态 MoE、超长上下文集成规格、Token Plan 上的真实端点,都说明 Alibaba 在 flagship 上继续加注。但这次发布也清晰暴露了中国 frontier 竞争的一个新形态:叙事可以先于证据,开放可以先于日历

对开发者来说,现在最合适的态度是:积极试用预览、严格记录配置、谨慎引用排名、等待权重与 benchmark 落地后再下结论。 当 Hugging Face 上出现带 license 的官方 Qwen 3.8 仓库的那一天,才是「soon」真正变成「日期」的时刻——在那之前,它只是一个尚未兑现的选项。

羽毛球分组比赛记分
小程序二维码

欢迎使用《羽毛球分组比赛记分》微信小程序

小夜