研究突破
Anthropic Claude 獨力完成費馬最後定理形式化證明:11 天、1300 萬行 Lean 程式碼
Anthropic 宣布 Claude 在 11 天內幾乎自主完成費馬最後定理(FLT)的完整電腦可驗證證明,產出 1300 萬行 Lean 程式碼與 29,500 個中間定理。數學界領袖 Kevin Buzzard 盛讚此為「非凡的自動形式化成就」。
Anthropic 宣布 Claude 在 11 天內幾乎自主完成費馬最後定理(FLT)的完整電腦可驗證證明,產出 1300 萬行 Lean 程式碼與 29,500 個中間定理。數學界領袖 Kevin Buzzard 盛讚此為「非凡的自動形式化成就」。
Inherent Labs 宣佈其 AI 研究代理 Faraday 在複現已發表科學論文成果的任務上,超越 Anthropic Claude Opus 4.8 與 OpenAI GPT-5.5,且僅基於 27B 參數的 Qwen 3.6 模型,證明「研究品味」可透過強化學習訓練而非模型規模達成。
Nvidia 最新研究顯示,透過自訂的 AVO 框架與監督代理架構,Claude Opus 5 在 ARC-AGI-3 互動推理基準上達到 100% 滿分,而無框架時僅得 30%,證明代理系統的軟體層比底層模型更能決定長期任務的成敗。
NASA 噴射推進實驗室與 Anthropic 確認,毅力號火星探測車成功完成人類史上首次由 AI 規劃的星際地面駕駛,全程 456 米路線由 Claude Code 分析軌道影像與地形數據後自主生成,規劃時間縮短約一半,為未來深空任務奠定基礎。
由多所頂尖大學聯合研究團隊報告,結合 o3 與 Gemini 2.0 Ultra 的混合 AI 系統在無人類引導的情況下,成功提出並驗證了一個困擾數學界逾百年的組合數學猜想的完整證明,這是 AI 在純數學研究中取得的里程碑式突破。