2026 年 9 月下旬,AI 產業經歷了近年來最密集的前緣模型發布潮。從 Anthropic 的 Claude Opus 5.5、OpenAI 的 GPT-6 Sol 與 Luna,到 xAI 的 Grok 4.7,三家實驗室在不到 48 小時內接連出招。在此背景下,Google DeepMind 新任主管 Koray Kavukcuoglu 於 The Information 的 AI Agenda Live 峰會上證實,次世代旗艦模型 Gemini 4 已正式進入後訓練階段(post-training),預計「遠早於」年底前發布。
Gemini 4 的關鍵節點
Kavukcuoglu 在 9 月 23-24 日的峰會上作出了他接掌 Google DeepMind 以來的首次公開亮相。他透露:
- 後訓練已啟動:Gemini 4 的基礎模型已完成預訓練(pre-training),現已進入使用人類反饋強化學習(RLHF)與專業資料 進行行為精煉的後訓練階段
- 內部測試中:Gemini 4 目前正在 Google 的 Antigravity 編碼工具內部進行測試
- 時間表加速:Kavukcuoglu 明確表示其目標是「盡快發布最早期的後訓練輸出」,因為已看到令人振奮的結果
Google 的節奏值得注意:該公司在 7 月 21 日才宣布啟動 Gemini 4 迄今規模最大的預訓練任務,從預訓練到後訓練僅約 兩個月,是一個極為壓縮的時間線——尤其是其前代產品 Gemini 3.5 Pro 自 6 月以來一直卡在夥伴測試階段。
競爭壓力:數據揭示的差距
Google 的急迫感在性能數據中清晰可見。根據 Intelligence Index v4.3.2 的評分:
| 模型 | 分數 |
|---|---|
| Anthropic Opus 5.5 | 57.6 |
| OpenAI GPT-6 Astra | 52.7 |
| OpenAI GPT-6 Sol | 47.5 |
| Google Gemini 3.6 Flash | 34.0 |
Gemini 3.6 Flash 與 Opus 5.5 之間 23.6 分的差距不是邊際落後——這是在前緣競爭與不在前緣競爭之間的區別。Gemini 4 肩負著縮小這個鴻溝的使命。
Kavukcuoglu 未披露 Gemini 4 的架構、參數數量、定價或基準測試結果。已知的資訊是模型「顯著大於」前代產品,並專注於編碼、自主代理與長時程代理工作流程——這些能力超越了文字生成,進入主動任務執行領域。
48 小時內重塑的定價結構
Kavukcuoglu 發言的時機本身就是故事的核心。在 9 月 21 日至 22 日期間,市場經歷了:
- xAI Grok 4.7:定價 $2/$6(輸入/輸出百萬 token)
- Anthropic Opus 5.5:定價 $4/$20
- OpenAI GPT-6 Sol 與 Luna:永久性 50% 降價
業界觀察人士指出,由 Anthropic CEO Dario Amodei 倡導、多家實驗室原則同意的協調定價框架(亦稱 Amodei pacing),在這 48 小時內實質上已經瓦解。Google 在這一波發布浪潮後立即確認 Gemini 4 的後訓練進度,是在向市場發出明確信號:Google 打算參與下一輪競爭,而非旁觀。
安全與速度的張力
Gemini 4 加速發布的同時,整個產業正在辯論另一個根本問題:誰來定義安全評估?
本週,聯合國安理會進行了實驗室 CEO 就其模型風險的聽證。OpenAI 發布了自己的評估框架。壓縮的後訓練時間線意味著安全測試的視窗也在縮短。對於一個在大約兩個月內從預訓練推進到後訓練的模型,其安全評估是否足夠徹底,是一個尚無答案的問題。
從更廣的視角看,Google 的組織變革——Demis Hassabis 在 8 月交出日常運營權力、Kavukcuoglu 接任——也增加了不確定性。Gemini 的兩位共同負責人在同日離職。新領導團隊能否兌現加速路線圖,將是未來一個季度的關鍵觀測指標。
結語
2026 年 9 月的最後一週,AI 前緣模型的三方競賽——OpenAI、Anthropic、Google DeepMind——已壓縮到自 GPT-4 時代以來最緊湊的狀態。Google 選擇了加速而非等待。這個選擇的結果——一個真正有競爭力的產品,還是一個過於倉促的發布——將是下一季最大的不確定性。
本文信息來源:Yahoo Finance、The Information、9to5Google、TechCrunch。