最重要的數字是六:按 Mark Zuckerberg 自己的說法,Meta 的新編程智能體在測試中同時、並行、零衝突地建構了一個遊戲的六個功能。Muse Code 於 8 月 5 日以 beta 發布,是 Meta 在終端編程智能體競賽中的入場:一個命令列工具,在大型倉庫上規劃變更、編寫程式碼、驗證結果,執行在新的 Muse Spark 1.2 模型上,一條命令即可安裝。
把它與聊天封裝區別開來的機制是扇形展開。任務足夠大時,Muse Code 會在隔離的 worktree 中派生並行工作的子智能體,因此使用者的工作副本在工作準備好合併前從不被觸碰。這與 Git worktree 給人類的架構答案相同,如今應用於智能體,也是大型實驗室首次將其作為預設而非選項交付。Zuckerberg 的六功能說法是廠商的演示,不是獨立測量,beta 也沒有附帶公開基準數字,所以證據的誠實狀態是:設計是對的,證明還欠著。
定位是要讀兩遍的部分。Meta 進入的是一場 OpenAI 的 Codex 和 Anthropic 的 Claude Code 已經擁有開發者的競賽,而 Meta AI 負責人 Alexandr Wang 對《華爾街日報》的賣點不是贏基準,而是成本:'對很多工作流和很多用例來說,這會是一個難以置信的好選擇,尤其是從成本角度看。'這是在一個全年都以基準為先的品類裡打出的價格優先牌,並與 Meta 六月進軍企業級客服智能體相呼應。Meta 不想在數字上擊敗在位者;它想成為你負擔得起一直執行的那個。
對本週評估它的建構者,清單很短。worktree 扇形展開值得在你自己的倉庫上測試,而不是看演示。成本主張需要你自己的 token 帳單,因為'負擔得起'取決於扇形展開在真實任務上派生多少子智能體。而懸而未決的問題是發布沒有回答的那個:Muse Spark 1.2 在同一程式碼庫上與 Codex 和 Claude Code 的當前模型相比如何,這個測量社群幾天內就會公開,而本編輯部對它的信任會超過發布會。
