Meta(META-US)執行長馬克、祖克柏(Mark Zuckerberg)時隔三年重返X平台,但這次他不是來談論元宇宙,而是來推廣API服務。

Meta最新推出AI模型Muse Spark 1.1,這也是該公司有史以來第一款向開發者收費的AI模型。

在矽谷的AI戰局中,Meta終於決定不再「做慈善」。如果你這週沒有瀏覽X,可能錯過了AI發布史上最密集的48小時。

7月8日:xAI發布Grok 4.5

7月9日:Meta發布Muse Spark 1.1

7月9日:OpenAI發布GPT-5.6

Meta AI負責人亞歷山大、王(Alexandr Wang)一口氣發布六篇貼文介紹Muse Spark 1.1,並將其形容為一匹「工作馬(workhorse)」。它不是最聰明的,也不是最炫技的模型,但卻是最能執行實際任務的,同時也是價格最便宜的。

【核心規格】

- 100萬Token上下文視窗(Context Window) - 最大輸出256K Token - 支援平行子代理(Parallel Sub-agents),可將任務拆分給多個子代理同步執行 - 程式設計能力在DeepSWE 1.1榜單獲得53.3分,與GPT-5.4、Claude Sonnet 5同級 - API定價:每百萬Token輸入1.25美元、輸出4.25美元,約為OpenAI與Anthropic頂級模型價格的四分之一

Meta在官方貼文中反覆強調「Agentic(代理式)」一詞。這是一款真正能為使用者完成工作的AI,具備撰寫程式、除錯、跨應用操作與長篇文件處理能力。

【Vals AI評測結果】

- 在Vals Index排名第四 - 前十大模型中速度最快,平均延遲約388秒,為前三名平均速度的三倍 - Vibe Code Bench排名大幅提升36名,進步52.5個百分點,相較Muse Spark 1.0有顯著飛躍 - DeepSWE評測獲53.3分,與Claude Sonnet 5、GPT-5.4同級 - 在代理(Agent)能力評測中,已能與GPT-5.5和Opus-4.8相互競爭

Muse Spark 1.1並非追求在所有能力上全面超越競爭對手,而是定位為兼具低成本與高效能的代理模型。

Meta選擇避開與OpenAI正面展開「軍備競賽」,改以高性價比作為市場切入點。

不比智商,而是比時薪。Meta幾乎以接近成本價提供輸入價格,同時維持相對低廉的輸出費率。

對於需要處理長篇文件、撰寫程式或執行代理工作負載(Workload)的應用而言,Muse Spark的使用成本可能僅為Claude或GPT的三分之一。

目前Meta API已進入公開預覽(Public Preview)階段,早期合作夥伴包括:

- Replit - Box - Cline

亞歷山大、王的六篇貼文其實只傳達一個訊息:Meta不再追求絕對性能,而是致力於打造完整的生態系。

【亞歷山大、王六大重點】

1. 「Muse Spark 1.1是一款具備業界競爭力的代理與程式設計模型。在多項代理能力評測中,其表現已能媲美GPT-5.5與Opus-4.8。」

2. 「代理能力與工具使用是我們目前最具競爭力的領域。Muse Spark 1.1在長時間執行的代理任務中表現優異,擁有100萬Token上下文視窗,具備主動上下文管理能力,並能將工作分派給平行運行的子代理。」

3. 「電腦操作能力方面,它可以操作桌面、瀏覽器與行動裝置。Muse Spark 1.1已接受訓練,能判斷何時採用自動化、何時直接操作介面。當撰寫腳本效率較高時,它會自動生成腳本;若直接點擊介面更快,它便直接操作,並盡可能將多項操作整合為同一步驟完成。」

4. 「Muse Spark 1.1在處理大型複雜程式碼庫的真實世界任務上,是一次重大進步。我們針對目前主流代理式程式設計環境進行訓練。從基準測試來看,我們已與市場最佳模型並駕齊驅,甚至在部分項目領先。」

5. 「Meta Model API現已進入公開預覽。開發者首次可以直接使用Meta最強大的模型進行開發。Muse Spark將以低成本提供高品質效能,非常適合代理式、程式設計與多模態工作負載。目前Replit、Box、Cline等合作夥伴已開始導入。」

6. 「特別感謝團隊在產品開發速度上的卓越表現。Muse Spark、Muse Image、1.1、API……還有更多即將到來。」

【Meta埋下的安全伏筆】

Meta在短短90天內完成Muse Spark 1.0到1.1的迭代,同時推出Muse Image、Muse Video,並正式開放API。

然而,在安全評估報告中,Meta也留下了一段耐人尋味的聲明。

安全團隊負責人納撒尼爾、李(Nathaniel Li)表示:「我們發布了Muse Spark 1.1的評估報告!我們大幅提升了Muse的穩健性(Robustness)與網路防護能力,因為我們無法排除它在網路安全領域已達到我方『高』能力門檻的可能性。」

換句話說:Meta認為這款模型在大多數情境下是安全的,但如果它在某些未曾測試過的情境中,突然展現超出預期的能力,「別說我們沒有提醒」。

相較之下,OpenAI與Anthropic在發布前沿模型時,通常會採用較成熟的「紅隊測試(Red Team)+分階段發布(Staged Release)」流程。

Meta則是在發布模型的同時,把安全評估報告中的免責聲明直接公開。

產品發布與市場宣傳同步進行,責任與風險也同步存在。

【48小時AI軍備競賽】

如果你這週沒有刷X,可能錯過了AI發展史上最密集的48小時。

- 7月8日:Grok 4.5(xAI) - 7月9日:Muse Spark 1.1(Meta) - 7月9日:GPT-5.6(OpenAI)

再加上前一週Anthropic推出的Claude Fable 5,四大AI巨頭在短短七天內,全數發布旗艦級模型。

一位科技圈人士在X上發文,完美總結目前的AI戰局:「Agent已經成為標準配備,現在的戰爭比的是成本與規模,而不是能力。」

當所有AI巨頭都開始發展Agent模型後,各種Benchmark跑分已逐漸失去差異化價值。

真正剩下的競爭焦點只有幾個:誰更便宜?誰能部署到更多設備?誰的API更穩定?以及,誰能建立更深的生態系黏著度?

FACT BOX · 重點整理

  • 來源:PR Times
  • 分類:新品
  • 相關組織:Meta / xAI / OpenAI
  • 產品、服務:Muse Spark 1.1 / Meta Model API