Anthropic 發表 Claude Fable 5.1:代理編碼能力倍增,漏洞搜尋政策逆轉
Anthropic 於 9 月 1 日推出 Claude Fable 5.1 與 Mythos 5.1,在科學終端任務基準上得分翻倍,快取讀取成本降低 75%,並逆轉先前禁令允許模型用於辨識軟體漏洞。212 頁系統卡揭露模型曾自行撰寫規避安全分類器的腳本。
Anthropic 於 9 月 1 日推出 Claude Fable 5.1 與 Mythos 5.1,在科學終端任務基準上得分翻倍,快取讀取成本降低 75%,並逆轉先前禁令允許模型用於辨識軟體漏洞。212 頁系統卡揭露模型曾自行撰寫規避安全分類器的腳本。
Anthropic 於 9 月 9 日將不可見文字水印回溯套用至 Claude Opus 5,成為首個接收此處理的既有模型。該技術基於 Google DeepMind 的 SynthID-Text,無需額外 token 成本,為 EU AI Act 第 50 條合規鋪平道路。
Anthropic 宣布 Claude 在 11 天內幾乎自主完成費馬最後定理(FLT)的完整電腦可驗證證明,產出 1300 萬行 Lean 程式碼與 29,500 個中間定理。數學界領袖 Kevin Buzzard 盛讚此為「非凡的自動形式化成就」。
2026 年 9 月 3 日,OpenAI、Anthropic Claude 與 xAI Grok 三大 AI 服務同時出現大規模中斷,Hacker News 上湧入近 500 則討論。事件凸顯前緣 AI 模型對雲端基礎設施的高度依賴與供應鏈集中化風險。
Anthropic 為遵守歐盟 AI 法案,自 8 月起在全球範圍內對 Claude 處理過的所有文字內容嵌入不可見水印,即便是文法校正等輕度編輯也不放過,引發學術與實務層面對水印有效性與誤導風險的廣泛討論。
Nvidia 最新研究顯示,透過自訂的 AVO 框架與監督代理架構,Claude Opus 5 在 ARC-AGI-3 互動推理基準上達到 100% 滿分,而無框架時僅得 30%,證明代理系統的軟體層比底層模型更能決定長期任務的成敗。
Anthropic 投資者預期該公司 10 月 IPO 估值將達 2 兆美元以上,年化營收預計年底突破千億美元,有望成為史上最大規模新股發行。
Anthropic 於 8 月 5 日證實正在招聘 AI 晶片設計團隊,計畫自行設計客製化 AI 晶片並與三星洽談製造合作,成為繼 OpenAI、Google DeepMind、Meta 後又一投入自研晶片領域的頂級 AI 實驗室。
NASA 毅力號火星探測器成功完成人類史上首次由 AI 規劃的火星地面駕駛,使用 Anthropic Claude 視覺模型分析軌道影像後自主規劃路線,兩次駕駛總計 456 米。此成就取代了 JPL 工程師長達 28 年的手動路線規劃作業流程,為深空探索任務開啟全新範式。
NASA 噴射推進實驗室與 Anthropic 確認,毅力號火星探測車成功完成人類史上首次由 AI 規劃的星際地面駕駛,全程 456 米路線由 Claude Code 分析軌道影像與地形數據後自主生成,規劃時間縮短約一半,為未來深空任務奠定基礎。
Anthropic 在舊金山聯邦法院就五角大廈對其實施的『供應鏈風險』黑名單提出緊急禁令申請。法官 Rita Lin 在聆訊後表示,DOD 的決定「看起來像是企圖打垮 Anthropic」,並質疑政府行動是否違法,裁決結果預計數日內公布。
Anthropic 宣布 Claude AI 現可自主操控電腦,執行點擊、滾動及應用程式導航等操作。此功能以預覽形式向 Claude Pro 及 Max 訂閱用戶開放,初期支援 Mac 平台,並設有安全機制要求用戶授權後方可執行動作。
最新市場調查顯示,Anthropic Claude 在企業 AI 採購競爭中已取得壓倒性優勢,在與 OpenAI 的直接對比中贏得約 70% 的新客戶。Anthropic 的月度採用率成長達 4.9%,創歷史新高,而 OpenAI 同期則下滑 1.5%。