阿里 Qwen 3.8 2.4T 參數預覽上線,開源權重「soon」成懸念

前言

2026 年 7 月 19 日,上海 WAIC(世界人工智能大會)期間,阿里巴巴 Qwen 團隊在 X 上宣佈 Qwen3.8-Max-Preview:總參數量 2.4 萬億,多模態輸入,宣稱能力「僅次於 Claude Fable 5」,並承諾將「soon」開放權重。預覽端點已可通過 Token Plan、Qoder、QoderWork 使用。

與 Kimi K3 在 7 月 16 日發佈時附帶 benchmark 表格、定價和 7 月 27 日放權日期不同,Qwen 3.8 的發佈幾乎只有一條推文:沒有 benchmark、沒有 model card、沒有正式 API 按 token 計價。開發者社區很快把討論焦點從「模型強不強」轉向一個更具體的問題:「soon」到底算不算日期?

本文基於 Qwen 官方公告、Qwen Cloud 文檔及多家媒體交叉覈實,梳理目前已確認的事實、仍懸而未決的指標,以及普通開發者應如何理性試用這一預覽版。

7 月 19 日:WAIC 上的「預覽」而非正式發佈

根據 Qwen 官方 X 帖文及 Bloomberg、Quartz 等媒體報道,Qwen3.8-Max-Preview 於 2026 年 7 月 19 日(週日) 對外公佈,發佈場景與 WAIC 2026 時間窗口重合。需要強調的是:當前上線的是 預覽端點,不是最終生產版本,更不是可下載的 open-weight 檢查點。

Qwen Cloud 文檔寫明,預覽期間模型會持續迭代,後續可能被下線或由正式版替代。因此,今天跑出來的結果,下週未必能復現——這在評估 frontier 模型時是一個硬約束。

官方給出的產品標識爲:

qwen3.8-max-preview

接入時務必使用完整 model ID,避免與舊款 Qwen3-8B(80 億參數小模型)混淆。Qwen3.8 是新的代際命名,2.4T 是其旗艦預覽規格。

2.4T MoE 與多模態:已確認與未披露

已覈實信息

項目 當前狀態
總參數量 2.4 萬億(Qwen 官方口徑)
架構 稀疏 Mixture-of-Experts(MoE),媒體與第三方綜述一致引用
多模態 支持文本、圖像、視頻、文檔輸入(官方與 GIGAZINE、TechTimes 等報道一致)
預覽接入 Token Plan、Qoder、QoderWork
開放權重 承諾「soon」,無日期、無許可證、無 Hugging Face 倉庫

Qwen 稱這是 Qwen 家族中首個總參數超過 1T 且具備多模態能力的旗艦預覽,在規模上確實跨了一個臺階。

仍未公開的關鍵指標

以下信息截至 2026 年 7 月 29 日,Qwen 尚未在正式 model card 或技術報告中披露

  1. 每 token 激活參數量(active parameters)——決定推理成本與 MoE 實際算力消耗;
  2. 完整 benchmark 表格與評測方法論
  3. 最終 open-weight 許可證(Apache 2.0 還是 Qwen 研究許可等);
  4. 標準 API 按百萬 token 定價(預覽期走 Credits 訂閱,見下文)。

第三方文檔(如 Qwen Cloud Codex 集成指南)列出了部分集成層參數:上下文窗口約 983,616 tokens、最大輸出 131,072 tokens、推理模式默認 xhigh 且不可關閉。這些屬於接入文檔中的集成規格,不能替代正式 model card,但比坊間「約 1M context」的二手說法更可靠。

「僅次於 Fable 5」:一句定位,零張表格

Qwen 原帖中的英文表述爲:compatible to leading frontier AI models, second only to Fable 5。多家媒體(Quartz、TechTimes、GIGAZINE)均指出:公告未附帶任何 benchmark 分數、評測配置或復現腳本

對比前代 Qwen3.7-Max(2026 年 5 月):當時 Alibaba 發佈了較完整的技術材料,例如在 Artificial Analysis Intelligence Index 上給出 56.6 分等指標。而 Qwen3.7 本身未開放權重,至少還有數據可看。

Qwen3.8 則連這一層都省了——在 LMArena 等第三方榜單上,截至發佈當週也沒有 Qwen3.8 的獨立排名條目;Claude Fable 5 仍居榜首,前代 Qwen3.7-Max 排名明顯靠後。因此:

「全球第二」目前是 廠商自我定位,不是可復現的評測結論。

獨立測試已有零星出現(如部分博主對 StackPerf 等任務的 matched test),但樣本量小、且預覽端點本身在變,不能當作官方 benchmark 的替代

「soon」是不是日期:開源懸念從哪來

這是本次發佈在中文開發者社區裏最火的分歧點。

Qwen 歷史上的「開放」與「封閉」

覈實 Qwen 近幾代旗艦策略,時間線大致如下:

代際 時間 權重策略 發佈材料完整度
Qwen3 及更早旗艦 2026 年前 多數提供可下載權重,多 Apache 2.0 較完整
Qwen3.6-Max-Preview 2026-04-20 首個封閉旗艦,僅 API 有 benchmark、定價
Qwen3.7-Max 2026-05 封閉,未承諾放權 有技術文檔與指標
Qwen3.8-Max-Preview 2026-07-19 預覽 API + 承諾 open-weight「soon」 無 benchmark、無日期

Qwen3.6、3.7 從未承諾過 Max 旗艦開源;Qwen3.8 則是 closed-preview 時代裏首次重新提起 open-weight 敘事的 Max 級模型。社區因此既期待又警惕:words 回來了,calendar 沒有。

爲什麼「soon」引發爭論

AI 評論者 Julien Simon 將 Kimi K3 與 Qwen 3.8 的發佈差異概括爲 「dated gap vs undated gap」

  • K3:有 benchmark、有 $15/M output tokens 定價、權重承諾 7 月 27 日——到期未交付是可證僞事件;
  • Qwen 3.8:同樣說 open-weight soon,但沒有截止日期——「soon」只能漂移,無法被「證僞」。

對開發者而言,這意味着:

  1. 不能把「soon」當成隱含的發佈日期做排期;
  2. 在 Hugging Face 出現帶 license 文件的官方倉庫之前,不宜稱其爲開源模型
  3. 即便未來放權,2.4T 總參數量在 4-bit 量化下也約需 1.2TB 級顯存(TechTimes 估算),多節點或更激進量化才現實——active 參數未披露前,自託管成本仍無法精算。

背景:K3 發佈三天後的「同周敘事」

時間線值得單獨記一筆:Kimi K3 於 7 月 16 日發佈,Qwen 3.8 於 7 月 19 日跟進。K3 當時被多家媒體稱爲中國廠商迄今定價最高的 frontier 模型之一(output 約 $15/百萬 token),並給出 7 月 27 日 open-weight 節點。

Bloomberg 報道指出,K3 發佈曾擾動全球科技股情緒;Qwen 3.8 公告後,阿里股價在下一個交易日一度上漲約 5.4%(Quartz 數據)。另有公開文件顯示,阿里巴巴曾以約 8 億美元取得 Moonshot(Kimi 母公司)約 36% 股權(2024 財年 20-F 報表,後續輪次或已稀釋)。兩家之間的競合關係,爲「同周雙 flagship 敘事」提供了資本市場視角,但不改變技術評估應以可復現證據爲準這一基本原則。

如何試用 Qwen3.8-Max-Preview

若要在可控前提下體驗預覽版,可按以下路徑操作。

1. Token Plan 訂閱(個人開發者主路徑)

Qwen Cloud Token Plan Individual 當前促銷檔(第三方整理,以官網爲準):

檔位 促銷月費 5 小時 Credits 上限 7 天 Credits 上限
Lite $6 700 2,500
Standard $18 3,000 10,000
Pro $68 12,000 40,000

預覽期模型消耗約爲標準價的 1/10;部分時段(UTC+8 22:00–08:00)可低至 1/50。注意:這是 Credits 制,不是已公佈的 Qwen 3.8 正式 API 單價。

2. Qoder / QoderWork

  • Qoder:面向代碼倉庫與軟件工程場景;
  • QoderWork:面向文檔、表格等知識工作流。

二者與 Token Plan 共用預覽額度邏輯,適合不想自建 Agent .harness 的開發者。

3. 第三方 Agent 工具接入

Qwen Cloud 文檔列出可與 Token Plan 聯動的工具,包括 Codex、Claude Code、Cursor、OpenCode、Cline 等。接入要點:

  1. 使用 API Key 時選擇模型 ID qwen3.8-max-preview
  2. 記錄測試日期與 reasoning level(默認 xhigh,可選 low / high / xhigh);
  3. 對比評測時固定 prompt、工具權限與倉庫快照;
  4. 統計的不只是答案質量,還有 Credits 消耗、延遲、重試次數——推理常開會讓同 prompt 成本波動很大。

4. 集成層已知限制(Codex 文檔)

  • 輸入:文本 + 圖像(視頻/文檔能力以官方最新文檔爲準);
  • Parallel tool calls:當前 metadata 標註爲不支持;
  • 內置工具:網頁搜索、代碼解釋器、爬蟲、以圖搜圖、文生圖搜索等(Harness tools)。

開發者評估清單:預覽可以測,不宜押生產

結合上文覈實結果,建議在技術選型或公衆號科普時採用下面這套「分級引用」規則:

  1. 可引用爲事實:7 月 19 日發佈、2.4T 總參數、MoE、多模態、三端預覽、qwen3.8-max-preview ID、承諾 open-weight soon;
  2. 應標註爲廠商主張:「僅次於 Fable 5」「frontier 級能力」;
  3. 應標註爲待定:放權日期、許可證、active 參數、正式 API 定價、穩定 model behavior;
  4. 暫不宜寫進 SLA:任何依賴固定行爲的線上業務。

若你正在 Kimi K3(7 月 27 日權重節點)與 Qwen 3.8 之間做選型,7 月底是一個 natural checkpoint:一邊是有日期的權重承諾,一邊是仍無日曆的「soon」。有日期的 claim 可以被驗證;沒有日期的 claim 只能被等待。

結語

Qwen3.8-Max-Preview 不是空穴來風——2.4T 多模態 MoE、超長上下文集成規格、Token Plan 上的真實端點,都說明 Alibaba 在 flagship 上繼續加註。但這次發佈也清晰暴露了中國 frontier 競爭的一個新形態:敘事可以先於證據,開放可以先於日曆

對開發者來說,現在最合適的態度是:積極試用預覽、嚴格記錄配置、謹慎引用排名、等待權重與 benchmark 落地後再下結論。 當 Hugging Face 上出現帶 license 的官方 Qwen 3.8 倉庫的那一天,纔是「soon」真正變成「日期」的時刻——在那之前,它只是一個尚未兌現的選項。

羽毛球分组比赛记分
小程序二维码

欢迎使用《羽毛球分组比赛记分》微信小程序

小夜