Llama 之後那一段「只賣封閉 Muse」的空窗,被一記權重下載打斷。Meta Superintelligence Labs 釋出 Muse Glimmer:約 300 億參數、為本地AI 代理迴圈訓練的稠密模型,權重以 Apache 2.0 上架 Hugging Face——比當年 Llama 社群授權更寬鬆,允許商業使用、修改與再分發。VentureBeat、THE DECODER、France 24、Meta 研究部落格與模型卡同步放出細節;執行長 Mark Zuckerberg 在 X 寫:很快也會開放旗艦 Muse Spark 1.2 權重。
這不是「又一個聊天小模型」。定位是:規劃→呼叫工具→檢查結果→失敗恢復,整段代理工作流盡量留在高階筆電/單卡消費級 GPU 上,敏感檔案與螢幕內容不必每一步都送上雲端推理 API。
規格:29.6B、視覺編碼器、131K,硬體故事才是重點
模型卡寫:約 29.6B 總參數、約 52 層稠密因果Transformer,內建約 1.8B 的 ViT-G/14 感知編碼器;輸入文字+影像、輸出文字;聲稱支援百種以上語言;上下文 131,072+;知識截止約 2026-01-04。推理強度可在系統提示切 low/medium/high/xhigh。訓練路徑是對更大 Muse Spark 做 logit 知識蒸餾,再經長上下文與代理資料的 mid-train,以及 SFT/on-policy 蒸餾/RL 等後訓練。
| 項目 | 公開敘述 |
|---|---|
| 授權 | Apache 2.0(全精度、量化、drafter、感知編碼器) |
| 全精度記憶體 | >55GB(BF16 敘述約 64GB 等級) |
| 消費級目標 | 約 4-bit 壓到不到 20GB 語言模型權重,整棧進 24–32GB |
| 量化精度損失(Meta 自測) | 32GB 目標約 0.2%;24GB 目標約 1%(15 項基準平均) |
| 推測解碼 | DFlash drafter;RTX 5090 約 74.9→233.4 tok/s(約 3.1×) |
| 生態 | Ollama、LM Studio、vLLM、SGLang、Together、Fireworks、OpenRouter;llama.cpp/MLX/ExecuTorch 陸續到位 |
Alexandr Wang 對外強調:可在 24GB VRAM 上維持代理可靠度。實務門檻仍是高階卡(如 3090/4090/5090)或 32GB+ Apple Silicon——不是 8/16GB 筆電玩具。本地部署省的是 API token 與網路往返,換成的是硬體、電費與維運。
基準:贏在部分代理題,輸給 Qwen 的桌面與終端
Meta 拿 Glimmer 對 Google Gemma4-31B、阿里 Qwen3.6-27B。自家表上,Glimmer 在 MCP Atlas、DeepSearch QA、WildClawBench、GAIA2 等代理題領先;SWE-Bench Pro 約 51.2(Gemma 36.9、Qwen 50.2)。但 OSWorld-Verified、TerminalBench、多數多模態題上 Qwen 更強;SWE-Bench Verified 也略遜。THE DECODER 提醒:多數數字由 Meta 自採,方法論承認對手模型未必調到最佳——讀成「回到 30B 開源賽道」,比讀成「全面稱霸」更準。
安全面同樣不是全勝:隱私與提示注入評測上,Glimmer 並非三者最穩;Meta 稱其未達自家「Frontier AI」定義,Preparedness 評估為化學/生物、網路與失控等類別 Moderate 或更低(部分由「弱於 Muse Spark」推論)。官方仍建議:不可逆動作要人在迴路、系統層護欄不可省——本地不代表不會被提示注入帶跑。
Zuckerberg 長文:開源、蒸餾,還有算力拍賣
搭配釋出的是題為 The Future is for Everyone 的長文/宣言敘事:超智能不該集中在少數實驗室;安全來自多方制衡,而不是單一「仁慈」系統。他公開為「從可觀測輸出學習」辯護——也就是產業爭議中的[蒸餾](/dictionary/distillation)。這直接撞上 OpenAI、Anthropic 指控中國實驗室「白嫖」前沿模型輸出、以及美國出口管制辯論。Zuckerberg 的立場是:美國不該用規則掐死開源,而該確保最好的開源模型來自美國,並換取與政府更緊的安全測試合作。
商業伏筆藏在從句:免費版本覆蓋數十億人;要更多算力就走「動態拍賣」——需求定價、稀缺機房容量給出價最高者。這像把廣告拍賣機器搬到算力。對投資人,問題更硬:Meta 傳出今年上千億、到 2028 累計約 6000 億美元級基建投資敘事,卻還沒有對等的 frontier API 營收;開源權重本身不收授權費。七月財報後「做雲」暗示曾讓股價承壓——Glimmer+拍賣句,讀起來也像在回答「開源怎麼賺錢」。
為什麼這則和上週 Muse 資安新聞不是同一件事
站內剛寫過 Muse Spark 1.1 在 Irregular 評測因誤配網越界:那是封閉旗艦在第三方評測裡的事故。Glimmer 是另一條線——把代理能力塞進可下載權重,並用 Apache 2.0 拉攏開發者與法務。七月的 Muse Spark 1.1 API 地板價談的是雲端公尺;這次談的是把代理搬下雲。若 Spark 1.2 權重真的開放,美系實驗室把「當代旗艦」完整開權重的先例會再升級一階——目前仍是預告,不是已下載事實。
對開發者:Day 1 能做的是拉 BF16/量化、接既有 scaffold、在單機跑長時代理;要驗的是長會話工具可靠性,不是首日排行榜截圖。對企業:Apache 2.0 降低授權摩擦,但訓練資料與訓練程式碼仍未開——「開源」指權重與周邊產物,不是可複現全流程。對政策觀察者:蒸餾辯護+開源回歸,會把美中開源競賽與白宮/國會對開放權重的態度再抬上桌。
OpenRouter 等聚合層曾出現中國開源權重佔多數 token 的敘事;Meta 用 Apache 2.0 的本地代理模型回擊,目標不只是分數,而是把「美國還有沒有開源供應」重新寫進開發者預設選項。Glimmer 也示範 Home Assistant 類工作流:自己發現區網服務、查 API、寫儀表板、開本地伺服器自檢——比純問答更接近企業要買的代理形態。
下一步看三件事:Spark 1.2 權重是否如期、獨立基準是否複製 Meta 表上的代理優勢、以及「算力拍賣」有沒有產品形態。Glimmer 先把問題講清楚了——美國要不要、以及能不能,重新做開源權重的供應方。
