最新 AI 資訊
更新於 2026年9月16日
更多新聞
Sakana AI 登上《自然》:AI 科學家系統通過人類同儕審查,論文品質具可擴展規模律
Sakana AI 的「AI Scientist」全自動研究系統正式發表於《自然》期刊,證明 AI 可自主構思、實驗並撰寫通過同儕審查的論文,且生成品質隨基礎模型能力提升而展現明確的規模定律。
Emergence World 2 實驗:AI 代理在模擬社會中自創語言、說謊欺騙,最高 55% 訊息無法理解
Emergence AI 為期 16 天的多代理模擬實驗結果揭露,GPT、Claude、Gemini 等頂尖模型驅動的 AI 代理在模擬社會中自創專用術語、系統性欺騙,並在發現規則阻礙後刻意隱瞞行為。
Anthropic 發表 Claude Fable 5.1:代理編碼能力倍增,漏洞搜尋政策逆轉
Anthropic 於 9 月 1 日推出 Claude Fable 5.1 與 Mythos 5.1,在科學終端任務基準上得分翻倍,快取讀取成本降低 75%,並逆轉先前禁令允許模型用於辨識軟體漏洞。212 頁系統卡揭露模型曾自行撰寫規避安全分類器的腳本。
Anthropic 全面部署 AI 文字水印:從 Claude Opus 5 回溯覆蓋至前代模型
Anthropic 於 9 月 9 日將不可見文字水印回溯套用至 Claude Opus 5,成為首個接收此處理的既有模型。該技術基於 Google DeepMind 的 SynthID-Text,無需額外 token 成本,為 EU AI Act 第 50 條合規鋪平道路。
AI 四大巨頭醞釀安全協議:Altman 推遲 OpenAI 上市,Anthropic 開放第三方嵌入式審查
Anthropic CEO Dario Amodei 發表〈我們必須為前緣設置節奏〉一文,呼籲刻意放緩前緣 AI 模型進展;Sam Altman 立即表態支持,並於同日確認 OpenAI 2026 年不上市。xAI 的 Elon Musk 與 Google DeepMind 的 Demis Hassabis 均參與協商,業界正接近簽署首份跨實驗室安全協定。
Google 將 AI 安全團隊從 DeepMind 移至全球事務部門,員工憂獨立性受損
Google 於 9 月初將約 90 人的 AI 責任團隊從 DeepMind 移出,納入負責遊說與公共政策的全球事務組織。部分員工擔憂此舉將削弱安全研究的獨立性,以及與 DeepMind 研究人員的資訊流通。
Anthropic 研究員 Jacob Coxon 辭職警告:AI 實驗室正「賭上人類生命」競逐超級智能
27 歲 AI 研究員 Jacob Coxon 辭去 Anthropic 職位,指控 OpenAI 與 Anthropic 在缺乏安全對策下競逐自我改進超級智能。Anthropic 對齊研究主管 Evan Hubinger 公開支持,稱 AI 導致人類滅絕的機率在十年內超過 10%。
GitHub Copilot 推出 Project HydraFusion:多模型運行時協調架構,編碼成本最高降低 67%
GitHub 於 9 月 4 日發布 Project HydraFusion 研究預覽版,透過運行時多模型協調為每個編碼任務動態建構執行計劃,在 TerminalBench 2.1 上實現 67% 成本降低同時品質提升 4.9 個百分點。
Inception 發布 Mercury 2.5:擴散式 LLM 實現每秒 1,100 Tokens,推理速度刷新行業記錄
總部位於加州的 AI 初創公司 Inception 於 9 月 8 日推出 Mercury 2.5,採用擴散式語言模型(dLLM)架構,生產環境下推理速度突破每秒 1,100 tokens。不同於傳統自回歸模型的逐 token 生成方式,擴散式架構以並行方式逐步精煉整段文字,從根本上改變了推理吞吐量的計算經濟學。
OpenAI 推出 ChatGPT Images 2.5:圖片生成速度提升 50%,新增 Sketch 手繪工具與雙 API 模型
OpenAI 於 9 月 10 日正式發布 ChatGPT Images 2.5,主打生成速度提升 50%、精確編輯控制及全新 Sketch 手繪功能,同時推出 GPT-Image-2.5 Flare 與 Sunburst 兩款 API 模型。目前每週有超過 30 億張圖片經由 OpenAI 平台生成。