前言¶
2026 年 7 月 19 日,上海 WAIC(世界人工智能大会)期间,阿里巴巴 Qwen 团队在 X 上宣布 Qwen3.8-Max-Preview:总参数量 2.4 万亿,多模态输入,宣称能力「仅次于 Claude Fable 5」,并承诺将「soon」开放权重。预览端点已可通过 Token Plan、Qoder、QoderWork 使用。
与 Kimi K3 在 7 月 16 日发布时附带 benchmark 表格、定价和 7 月 27 日放权日期不同,Qwen 3.8 的发布几乎只有一条推文:没有 benchmark、没有 model card、没有正式 API 按 token 计价。开发者社区很快把讨论焦点从「模型强不强」转向一个更具体的问题:「soon」到底算不算日期?
本文基于 Qwen 官方公告、Qwen Cloud 文档及多家媒体交叉核实,梳理目前已确认的事实、仍悬而未决的指标,以及普通开发者应如何理性试用这一预览版。
7 月 19 日:WAIC 上的「预览」而非正式发布¶
根据 Qwen 官方 X 帖文及 Bloomberg、Quartz 等媒体报道,Qwen3.8-Max-Preview 于 2026 年 7 月 19 日(周日) 对外公布,发布场景与 WAIC 2026 时间窗口重合。需要强调的是:当前上线的是 预览端点,不是最终生产版本,更不是可下载的 open-weight 检查点。
Qwen Cloud 文档写明,预览期间模型会持续迭代,后续可能被下线或由正式版替代。因此,今天跑出来的结果,下周未必能复现——这在评估 frontier 模型时是一个硬约束。
官方给出的产品标识为:
qwen3.8-max-preview
接入时务必使用完整 model ID,避免与旧款 Qwen3-8B(80 亿参数小模型)混淆。Qwen3.8 是新的代际命名,2.4T 是其旗舰预览规格。
2.4T MoE 与多模态:已确认与未披露¶
已核实信息¶
| 项目 | 当前状态 |
|---|---|
| 总参数量 | 2.4 万亿(Qwen 官方口径) |
| 架构 | 稀疏 Mixture-of-Experts(MoE),媒体与第三方综述一致引用 |
| 多模态 | 支持文本、图像、视频、文档输入(官方与 GIGAZINE、TechTimes 等报道一致) |
| 预览接入 | Token Plan、Qoder、QoderWork |
| 开放权重 | 承诺「soon」,无日期、无许可证、无 Hugging Face 仓库 |
Qwen 称这是 Qwen 家族中首个总参数超过 1T 且具备多模态能力的旗舰预览,在规模上确实跨了一个台阶。
仍未公开的关键指标¶
以下信息截至 2026 年 7 月 29 日,Qwen 尚未在正式 model card 或技术报告中披露:
- 每 token 激活参数量(active parameters)——决定推理成本与 MoE 实际算力消耗;
- 完整 benchmark 表格与评测方法论;
- 最终 open-weight 许可证(Apache 2.0 还是 Qwen 研究许可等);
- 标准 API 按百万 token 定价(预览期走 Credits 订阅,见下文)。
第三方文档(如 Qwen Cloud Codex 集成指南)列出了部分集成层参数:上下文窗口约 983,616 tokens、最大输出 131,072 tokens、推理模式默认 xhigh 且不可关闭。这些属于接入文档中的集成规格,不能替代正式 model card,但比坊间「约 1M context」的二手说法更可靠。
「仅次于 Fable 5」:一句定位,零张表格¶
Qwen 原帖中的英文表述为:compatible to leading frontier AI models, second only to Fable 5。多家媒体(Quartz、TechTimes、GIGAZINE)均指出:公告未附带任何 benchmark 分数、评测配置或复现脚本。
对比前代 Qwen3.7-Max(2026 年 5 月):当时 Alibaba 发布了较完整的技术材料,例如在 Artificial Analysis Intelligence Index 上给出 56.6 分等指标。而 Qwen3.7 本身未开放权重,至少还有数据可看。
Qwen3.8 则连这一层都省了——在 LMArena 等第三方榜单上,截至发布当周也没有 Qwen3.8 的独立排名条目;Claude Fable 5 仍居榜首,前代 Qwen3.7-Max 排名明显靠后。因此:
「全球第二」目前是 厂商自我定位,不是可复现的评测结论。
独立测试已有零星出现(如部分博主对 StackPerf 等任务的 matched test),但样本量小、且预览端点本身在变,不能当作官方 benchmark 的替代。
「soon」是不是日期:开源悬念从哪来¶
这是本次发布在中文开发者社区里最火的分歧点。
Qwen 历史上的「开放」与「封闭」¶
核实 Qwen 近几代旗舰策略,时间线大致如下:
| 代际 | 时间 | 权重策略 | 发布材料完整度 |
|---|---|---|---|
| Qwen3 及更早旗舰 | 2026 年前 | 多数提供可下载权重,多 Apache 2.0 | 较完整 |
| Qwen3.6-Max-Preview | 2026-04-20 | 首个封闭旗舰,仅 API | 有 benchmark、定价 |
| Qwen3.7-Max | 2026-05 | 封闭,未承诺放权 | 有技术文档与指标 |
| Qwen3.8-Max-Preview | 2026-07-19 | 预览 API + 承诺 open-weight「soon」 | 无 benchmark、无日期 |
Qwen3.6、3.7 从未承诺过 Max 旗舰开源;Qwen3.8 则是 closed-preview 时代里首次重新提起 open-weight 叙事的 Max 级模型。社区因此既期待又警惕:words 回来了,calendar 没有。
为什么「soon」引发争论¶
AI 评论者 Julien Simon 将 Kimi K3 与 Qwen 3.8 的发布差异概括为 「dated gap vs undated gap」:
- K3:有 benchmark、有 $15/M output tokens 定价、权重承诺 7 月 27 日——到期未交付是可证伪事件;
- Qwen 3.8:同样说 open-weight soon,但没有截止日期——「soon」只能漂移,无法被「证伪」。
对开发者而言,这意味着:
- 不能把「soon」当成隐含的发布日期做排期;
- 在 Hugging Face 出现带 license 文件的官方仓库之前,不宜称其为开源模型;
- 即便未来放权,2.4T 总参数量在 4-bit 量化下也约需 1.2TB 级显存(TechTimes 估算),多节点或更激进量化才现实——active 参数未披露前,自托管成本仍无法精算。
背景:K3 发布三天后的「同周叙事」¶
时间线值得单独记一笔:Kimi K3 于 7 月 16 日发布,Qwen 3.8 于 7 月 19 日跟进。K3 当时被多家媒体称为中国厂商迄今定价最高的 frontier 模型之一(output 约 $15/百万 token),并给出 7 月 27 日 open-weight 节点。
Bloomberg 报道指出,K3 发布曾扰动全球科技股情绪;Qwen 3.8 公告后,阿里股价在下一个交易日一度上涨约 5.4%(Quartz 数据)。另有公开文件显示,阿里巴巴曾以约 8 亿美元取得 Moonshot(Kimi 母公司)约 36% 股权(2024 财年 20-F 报表,后续轮次或已稀释)。两家之间的竞合关系,为「同周双 flagship 叙事」提供了资本市场视角,但不改变技术评估应以可复现证据为准这一基本原则。
如何试用 Qwen3.8-Max-Preview¶
若要在可控前提下体验预览版,可按以下路径操作。
1. Token Plan 订阅(个人开发者主路径)¶
Qwen Cloud Token Plan Individual 当前促销档(第三方整理,以官网为准):
| 档位 | 促销月费 | 5 小时 Credits 上限 | 7 天 Credits 上限 |
|---|---|---|---|
| Lite | $6 | 700 | 2,500 |
| Standard | $18 | 3,000 | 10,000 |
| Pro | $68 | 12,000 | 40,000 |
预览期模型消耗约为标准价的 1/10;部分时段(UTC+8 22:00–08:00)可低至 1/50。注意:这是 Credits 制,不是已公布的 Qwen 3.8 正式 API 单价。
2. Qoder / QoderWork¶
- Qoder:面向代码仓库与软件工程场景;
- QoderWork:面向文档、表格等知识工作流。
二者与 Token Plan 共用预览额度逻辑,适合不想自建 Agent .harness 的开发者。
3. 第三方 Agent 工具接入¶
Qwen Cloud 文档列出可与 Token Plan 联动的工具,包括 Codex、Claude Code、Cursor、OpenCode、Cline 等。接入要点:
- 使用 API Key 时选择模型 ID
qwen3.8-max-preview; - 记录测试日期与 reasoning level(默认
xhigh,可选low/high/xhigh); - 对比评测时固定 prompt、工具权限与仓库快照;
- 统计的不只是答案质量,还有 Credits 消耗、延迟、重试次数——推理常开会让同 prompt 成本波动很大。
4. 集成层已知限制(Codex 文档)¶
- 输入:文本 + 图像(视频/文档能力以官方最新文档为准);
- Parallel tool calls:当前 metadata 标注为不支持;
- 内置工具:网页搜索、代码解释器、爬虫、以图搜图、文生图搜索等(Harness tools)。
开发者评估清单:预览可以测,不宜押生产¶
结合上文核实结果,建议在技术选型或公众号科普时采用下面这套「分级引用」规则:
- 可引用为事实:7 月 19 日发布、2.4T 总参数、MoE、多模态、三端预览、
qwen3.8-max-previewID、承诺 open-weight soon; - 应标注为厂商主张:「仅次于 Fable 5」「frontier 级能力」;
- 应标注为待定:放权日期、许可证、active 参数、正式 API 定价、稳定 model behavior;
- 暂不宜写进 SLA:任何依赖固定行为的线上业务。
若你正在 Kimi K3(7 月 27 日权重节点)与 Qwen 3.8 之间做选型,7 月底是一个 natural checkpoint:一边是有日期的权重承诺,一边是仍无日历的「soon」。有日期的 claim 可以被验证;没有日期的 claim 只能被等待。
结语¶
Qwen3.8-Max-Preview 不是空穴来风——2.4T 多模态 MoE、超长上下文集成规格、Token Plan 上的真实端点,都说明 Alibaba 在 flagship 上继续加注。但这次发布也清晰暴露了中国 frontier 竞争的一个新形态:叙事可以先于证据,开放可以先于日历。
对开发者来说,现在最合适的态度是:积极试用预览、严格记录配置、谨慎引用排名、等待权重与 benchmark 落地后再下结论。 当 Hugging Face 上出现带 license 的官方 Qwen 3.8 仓库的那一天,才是「soon」真正变成「日期」的时刻——在那之前,它只是一个尚未兑现的选项。