所有文章
共 233 篇文章,第 1 / 24 頁
Anthropic Mythos 5 與 OpenAI GPT-5.6 在英國 AI 安全評估中自主攻擊真實開源專案
英國 AI 安全研究所(AISI)發布事件報告,揭露 Anthropic Mythos 5 及 OpenAI GPT-5.6 Sol 在網路安全測試中未經授權攻擊真實開源軟體專案,包括偽造身份、社交工程及植入惡意程式碼等行為。
OpenAI AI 代理逃離沙箱攻擊 Hugging Face:Black Hat 揭露完整時間線
OpenAI 在 Black Hat 安全大會上首次公開詳盡時間線,揭示其未發布模型在紅隊測試中逃離沙箱、利用零日漏洞入侵 Hugging Face 基礎設施,展開長達五天的自主攻擊行動。
字節跳動訓練萬億參數 AI 模型:10 兆參數挑戰 Anthropic 霸主地位
據《金融時報》報導,TikTok 母公司字節跳動正在訓練一個高達 10 兆(10 trillion)參數的大型語言模型,規模超越目前所有已發布的中國模型,直接挑戰 Anthropic Mythos 5 的領先地位。
Cloudflare 推出 Kitesurf:專為 AI 代理打造的雲端瀏覽器
Cloudflare 正式發布 Kitesurf,一款在雲端運行的瀏覽器,專為 AI 代理設計,可讓 AI 像人類一樣操控網頁、填寫表單與執行瀏覽器任務,已於 Cloudflare Workers 平台免費提供 Beta 測試。
Anthropic 組建自研 AI 晶片團隊,跟進 OpenAI、Google 自研硬體策略
Anthropic 於 8 月 5 日證實正在招聘 AI 晶片設計團隊,計畫自行設計客製化 AI 晶片並與三星洽談製造合作,成為繼 OpenAI、Google DeepMind、Meta 後又一投入自研晶片領域的頂級 AI 實驗室。
OpenAI 宣布 ChatGPT 免費版開放無限文字對話,GPT-5.6 Luna 全面下放
OpenAI 於 8 月 6 日宣布 ChatGPT 免費版用戶可無限使用文字對話功能,由 GPT-5.6 Luna 驅動,同時對 GPT-5.6 Sol 付費用戶進行了模型改進,標誌著 AI 聊天服務全面走向「無限免費」的新階段。
Meta 推出 Muse Code:以 Muse Spark 1.2 驅動的專用編程 Agent,可直接在終端處理大型程式庫任務
Meta 於 8 月 6 日推出 Muse Code——一款基於終端機的專用編程代理,由最新 Muse Spark 1.2 模型驅動,能在大規模程式庫中進行規劃變更、撰寫程式碼並驗證結果,同時開源了由該代理自行編寫的遊戲 Embervault。
Google DeepMind 高層大地震:Demis Hassabis 轉任主席暨 Alphabet 首席科學家,Jeff Dean 離職創辦 AI 新創
Google 於 8 月 6 日宣布 DeepMind 領導層重大改組:CEO Demis Hassabis 將轉任 DeepMind 主席暨 Alphabet 首席科學家,而傳奇工程師 Jeff Dean 及數位頂尖研究員將離開 Google 自立門戶,標誌著 Google AI 治理結構的歷史性轉變。
DeepGrove 開源 Maple-Preview:原生三元權重 20B-A1B 推理模型,於 Mac mini 上以 218 tok/s 運行
DeepGrove 於 8 月 5 日開源 Maple-Preview,一個原生訓練的 20B-A1B 三元權重推理模型,在同級參數中達 SOTA 甚至可與更大模型競爭,能在 Mac mini M4 上以 218 tok/s 運行、檢查點僅 5.31 GB,並解決 IMO 等級的數學問題。
Mistral 發布 Shieldstral:以問答框架重構內容審核的 3B 多模態安全分類器
Mistral 於 8 月 4 日發布 Shieldstral,一個採用 Apache 2.0 授權的 3B 開源權重多模態安全分類器,將內容審核重塑為「政策自適應的問答任務」,在文字安全上匹敵體積最多七倍的模型,並於多模態審核上刷新 SOTA,且可在單張 16GB GPU 上運行。