阿里 Qwen 3.8-Max 發佈:2.4T 參數 Max 級模型首次開源
2026年8月3日阿里雲正式發佈 Qwen 3.8-Max:2.4T 總參數、95B 激活的稀疏 MoE,100 萬 token 上下文,多模態輸入。這是 Qwen-Max 級模型首次承諾開源權重,預計下週登陸 Hugging Face 與 ModelScope。API 已在 QwenCloud、Model Studio 及 Vercel AI Gateway(alibaba/qwen3.8-max)上線,並支持 Claude Code、Codex 等 Agent 工具。本文梳理已覈實規格、長程 Agent 能力要點與接入方式,供開發者評估調用或等待自託管。
閱讀全文Moonshot 開源 2.8T 參數 Kimi K3:迄今最大規模開放權重前沿模型
2026 年 7 月 27 日,Moonshot AI 在 Hugging Face 發佈 Kimi K3 完整權重:總參數 2.8T、每 token 激活 104B,MXFP4 格式約 1.56 TB(96 個 safetensors 分片),官方稱系全球首個開放 3T 級模型。本文梳理其 Stable LatentMoE 架構(896 選 16 專家)、KDA 注意力、100 萬 token 上下文、MoonViT-V2 多模態能力,以及自託管門檻與 API 接入方式,供開發者評估部署與集成方案。
閱讀全文Moonshot 開源 Kimi K3:2.8T 參數 MoE、104B 激活、100 萬上下文的開源前沿模型
2026 年 7 月 27 日,Moonshot AI 在 Hugging Face 與 GitHub 發佈 Kimi K3 完整權重:2.8T 總參數 MoE、896 專家中激活 16 個、104B 激活參數、100 萬 token 上下文與原生多模態。本文基於官方 README 與 arXiv 技術報告,梳理 KDA、Stable LatentMoE 架構要點,解讀 Terminal-Bench 等 Agent 評測及 harness 差異,並介紹 API 與 vLLM/SGLang 部署路徑與 Kimi K3 License 使用邊界。
閱讀全文阿里 Qwen 3.8 2.4T 參數預覽上線,開源權重「soon」成懸念
2026年7月19日WAIC期間,阿里Qwen團隊發佈2.4萬億參數多模態預覽版Qwen3.8-Max-Preview,宣稱能力僅次於Claude Fable 5,並承諾open-weight「soon」。與Kimi K3帶benchmark和放權日期不同,本次公告無評測表格、無model card、無權重開源時間表。本文交叉覈實官方與媒體報道,梳理MoE架構、Token Plan/Qoder接入方式、Qwen旗艦開放策略變遷,以及開發者應如何區分「可驗證事實」與「廠商定位」,理性試用這一仍在迭代的預覽端點。
閱讀全文Kimi K3 開源權重落地,中國開源大模型競賽再升溫
2026 年 7 月 27 日,月之暗面正式開放 Kimi K3 完整模型權重,這是全球首個 2.8T 參數級開源 MoE 模型,支持 100 萬 token 上下文與原生多模態。Hacker News 單帖熱度超 600 點,社區圍繞其與 Claude Fable 5 的性能對比及蒸餾爭議展開激烈討論。本文梳理 K3 架構規格、benchmark 定位、阿里 36% 持股背景,以及 API 與本地部署的開發者上手指南。
閱讀全文