週日(7 月 19 日)上海 WAIC 剛落幕,阿里 Qwen 團隊就在 X 丟出下一顆棋子:Qwen3.8-Max-Preview——官方稱 2.4 兆參數、家族首個破兆且支援圖像、影片、文件的多模態旗艦,並用一句話定調:「僅次 Fable 5,是當今最強模型之一。」到週一(7 月 21 日),港股市場用股價投票:阿里集團據多家媒體轉引一度漲約 5.4%;矽谷與媒體的問題卻更冷:benchmark 在哪?活躍參數多少?開放權重何時、何授權?
這是繼 Moonshot Kimi K3 之後,中國 AI 週的第二響——但阿里這一響的證據包,比 K3 還薄。
已知規格 vs 刻意留白
| 已公布 | 未公布 |
|---|---|
| 總參數 2.4T | 每 token 活躍參數(MoE 架構下關鍵) |
| 多模態:文字+圖像+影片+文件 | 獨立 model card |
| 預覽通路:Token Plan、Qoder、QoderWork | LMArena/Artificial Analysis 等第三方分數 |
| 試用定價約為標準價 10% | 開放權重 日期與授權條款 |
首席開發者帥柏(Shuai Bai)稱這是 Qwen 首個破兆多模態模型,理解力「達到或超越領先閉源系統」;團隊預期在程式、全端開發、資料分析、辦公流程上優於 Qwen3.7-Max(五月發布時曾附 Artificial Analysis 56.6 等公開數據)。3.8 預覽版卻零表格——與 3.7 的發布紀律形成反差,也讓「僅次 Fable 5」純屬廠商自評。
SiliconANGLE 與 IBTimes 的共同結論:不能說阿里在說謊,只能說還沒被獨立驗證。
與 Fable 5、K3 的三角關係
| 模型 | 參數(宣稱) | 證據狀態 | API 定價(參考) |
|---|---|---|---|
| Claude Fable 5 | 未公開 | LMArena 榜首、廣泛第三方評測 | $10 / $50 per 1M Token |
| Kimi K3 | 2.8T | Arena WebDev #1、AA 智能指數第四;權重 7/27 | $3 / $15 |
| Qwen3.8-Max-Preview | 2.4T | 僅官方聲明;託管預覽 | Token Plan 試用約標準價 10% |
Fable 5 仍是閉源標竿;K3 已用第三方初評搶下「開源/開放權重 程式」敘事;Qwen3.8 則押「多模態+企業辦公」,並承諾日後開放權重——若兌現,將打破阿里 Max 檔長期閉源慣例,但 「soon」沒有日曆。
值得注意的是:7 月 21 日 Moonshot 因 GPU 滿載暫停 K3 新訂閱——阿里若真要把 2.4T 多模態推到海量用戶,同樣要回答 推理 成本。MarkTechPost 估算:2.4T 模型若 4-bit 量化,權重 alone 約 1.2TB;單卡 H200 約 141GB——自架數學很殘酷,沒有活躍參數就無法談經濟性。
為什麼股市先動、工程師該慢動
股價反映的是「中國能否連續丟出對標 Fable 5 的敘事」,在 Gemini 3.5 Pro 第三次跳票 與美系閉源漲價並行的當口,投資人需要新故事。
採購與開發則應區分三層:
- 預覽可用:已可透過阿里 Token Plan/Qoder 試用,支援 OpenAI/Anthropic 風格 tool calling(官方宣稱)——適合 PoC。
- 性能未證:勿把「第二 only Fable 5」寫進 RFP,直到獨立 benchmark 或自有 eval 跑完。
- 開放權重待定:若授權友好,才可能複製 Inkling/K3 的企業自架 路線;否則仍是雲鎖定。
地緣與 WAIC 餘溫
Qwen3.8 發布卡在 WAIC 閉幕後、與 WAICO 29 國治理簽署 同一輿論週——上海輸出「標準+模型」雙線敘事。美系這邊,Hugging Face 遭自主代理入侵 與 新加坡 GenAI 透明度規則 則凸顯「安全與合規」主線。Qwen3.8 預覽本身不碰監管,但會影響誰敢在跨國產品裡預設中國託管旗艦。
企業買家該問的五個問題
在把 Qwen3.8 寫進年度採購前,建議直接向阿里或合作雲廠確認:
- 活躍參數與 MoE 路由:決定單次請求成本曲線。
- 多模態計費:影片/文件是否按幀或按頁額外計費。
- 資料駐留:訓練與 推理 是否可限定區域(對跨國金融客戶關鍵)。
- 與 Qwen3.7-Max 的遷移路徑:API 名稱、breaking change 時程。
- 開放權重時間表:是否與 Kimi K3 的 7/27 形成同週「中國開源週」。
驗證清單(建議 7 月底前盯)
- Artificial Analysis/LMArena 是否出現 Qwen3.8 分數
- model card:活躍參數、上下文、安全評測
- 開放權重:日期、MIT/Apache/商用條款
- 與 Qwen3.7-Max 的任務級對照(coding、agent、多模態 OCR)
- 託管延遲與限流政策(對照 K3 算力瓶頸)
在證據補齊前,Qwen3.8-Max-Preview 最準確的描述是:阿里對「全球第二」的押注單——市場週一已部分買單,工程界仍應等 benchmark 落地再改架構。若權重與分數後來證實接近宣稱,這會是繼 DeepSeek 之後又一次動搖「只有美系能做大旗艦」的敘事;若證偽,則只是 WAIC 週的一則高聲量預告。
同一週 Kimi K3 因 GPU 滿載暫停新訂閱 提醒:就算 benchmark 好看,託管容量仍是第二道門檻。對採購者而言,7 月 21 日的股價不是成績單,預覽 API 裡的實測與下週的獨立榜單才是。
