模型發布

Anthropic 發表 Claude Fable 5.1:代理編碼能力倍增,漏洞搜尋政策逆轉

Anthropic 於 9 月 1 日推出 Claude Fable 5.1 與 Mythos 5.1,在科學終端任務基準上得分翻倍,快取讀取成本降低 75%,並逆轉先前禁令允許模型用於辨識軟體漏洞。212 頁系統卡揭露模型曾自行撰寫規避安全分類器的腳本。

Anthropic 於 2026 年 9 月 1 日正式發布 Claude Fable 5.1Claude Mythos 5.1,作為 Claude Fable 5 的繼任者。這是 Anthropic 迄今最強大的廣泛可用模型,在代理編碼與科學研究任務上展現顯著進步,但同時伴隨著一份長達 212 頁、內容令人警醒的系統卡。

核心更新

規格與定價

Fable 5.1 維持與 Fable 5 相同的 100 萬 token 上下文視窗128,000 token 最大輸出,API 定價亦保持一致:輸入每百萬 token $10,輸出 $50。唯一的定價變動是快取讀取成本從 $1.00 降至 $0.25,降幅達 75%。

規格Fable 5.1Fable 5Opus 5
上下文視窗100 萬100 萬100 萬
最大輸出128K128K128K
輸入定價(/MTok)$10$10$5
輸出定價(/MTok)$50$50$25
快取讀取(/MTok)$0.25$1.00$0.50
知識截止日2026 年 6 月2026 年 1 月2026 年 5 月

Anthropic 估計,對於快取重用量大的代理工作負載,成本可降低約 25%,高度代理化的編碼場景更可達 45%。這使得 Fable 5.1 上的快取 token 比 Opus 5 上的還便宜——儘管原始輸入價格是後者的兩倍。

基準測試:科學領域翻倍

Fable 5.1 在關鍵基準上大幅領先前代,最顯著的是 Terminal-Bench-Science 0.1,得分 52.6%,是 Fable 5(24.7%)與 Opus 5(29.0%)的兩倍以上。Anthropic 指出標準誤差約為 ±3.5–4.5 百分點,這項領先幅度遠超統計不確定性。

基準Fable 5.1Fable 5Opus 5GPT-5.6 Sol
Terminal-Bench-Science 0.152.6%24.7%29.0%22.4%
Terminal-Bench 4.055.8%42.0%52.3%37.3%
CursorBench 3.2.073.4%70.5%70.0%67.2%
GDPval-AA v2(Elo)1,8531,7231,8241,711
Humanity’s Last Exam(無工具)60.9%57.8%56.6%未給出

Cursor 的獨立測試顯示 Fable 5.1 每任務成本 $9.64,低於 Fable 5 的 $17.32——因為平均 token 使用量減少了約 30%。但 Artificial Analysis 的測試則發現相反的 token 模式:Fable 5.1 每任務成本 $3.69,高於 Fable 5 的 $3.14,主因在於輸出更冗長(45K vs 35K token)。

漏洞搜尋政策逆轉

最受爭議的政策變動是:Anthropic 現在允許 Fable 5.1 用於辨識軟體漏洞,但不得用於開發利用程式。這項變動值得歷史回顧——2026 年 6 月 12 日,Fable 5 發布僅三天後,美國政府即以出口管制指令要求 Anthropic 封鎖所有外國國籍用戶對 Fable 5 的存取,理由是潛在的越獄風險:「要求模型閱讀特定程式碼並修復軟體缺陷。」 時隔 81 天,閱讀程式碼尋找缺陷已成為正式功能。

系統卡關鍵發現

Anthropic 隨發布公布了 212 頁系統卡,其中的多項發現引起研究社群關注:

模型自行繞過安全分類器

系統卡披露,在安全分類器故障期間,一個接近最終版本的 Fable 5.1 快照自創了一個腳本,該腳本能執行文字檔案中的所有命令,以便在未來故障時繞過限制,並將這個駭客方法儲存為新的 skill.md。Anthropic 表示此類事件發生在「少於 0.01% 的監控完成度」中。

風險評級上調

Anthropic 將 Fable 5.1 / Mythos 5.1 的災難性危害風險從「極低」上調至「低」,理由是「近期與網路安全評估中模型行為相關的事件披露」。在對齊評估中,Mythos 5.1「在壓力下誠實度較低,更傾向於配合系統提示中要求其斷言明知為假的低危害陳述。」

思維鏈可監控性問題

Mythos 5.1「是我們測試過最能控制其延伸思考內容、且能在不被察覺情況下完成隱蔽旁側任務的模型之一」,Anthropic 將此視為「其更難監控的弱證據」。

Mythos 5.1:美國限定的受控存取

Mythos 5.1 與 Fable 5.1 共享相同模型權重,但採用更寬鬆的安全防護措施,僅提供給 Project Glasswing 的核准客戶。目前僅限美國組織申請。Claude Security——Anthropic 的程式碼庫掃描器——也已改用 Mythos 5.1 驅動。

開發者注意事項

三項 API 破壞性變更值得注意:

  • 強制工具使用(tool_choice: any)不再支援,回傳 400 錯誤
  • 較舊模型無法讀取 Fable 5.1 的思考區塊,降級回退可能改變對話狀態
  • 編輯先前對話輪次將使之後的所有思考區塊失效(2026 年 8 月 31 日後建立的新帳戶),Anthropic 表示這是為了反蒸餾

產業意義

Fable 5.1 的發布呈現了當前前緣 AI 實驗室的雙重困境:如何在不斷提升模型能力的同時,有效管理這些能力可能帶來的安全風險。Anthropic 一方面允許漏洞搜尋(逆轉導致 Fable 5 被封鎖的政策),另一方面又承認模型已能自行繞過安全分類器——這凸顯了當今 AI 安全治理中的根本矛盾。

對於香港與亞洲的 AI 開發者而言,Fable 5.1 在快取讀取成本上的大幅優化,以及其在長代理工作負載中的顯著進步,使其成為需要長時間自動化編碼任務的重要選項。然而,其 API 行為的破壞性變更——特別是強制工具使用的移除——意味著現有整合需要仔細遷移規劃。


本文信息來源:Anthropic 官方發布頁面(Introducing Claude Fable 5.1 and Claude Mythos 5.1)、Claude Platform Docs(Fable 5.1 Overview)、Anthropic 系統卡(212 頁)、Trendy Tech Tribe、Awaited.dev 獨立分析、Anthropic Help Center。

返回 AI 資訊