跳至正文
Gemini 4 Link
English简体中文繁體中文DeutschEspañolPortuguês

Gemini 4 正式發布:首款模型 Argon 上線,但多數人還用不上

Gemini 4 是 Google 自 2025 年 11 月 Gemini 3 系列以來第一個全新旗艦世代。2026 年 9 月 30 日的公告只點名了一款模型 Argon,而且沒有先給一般使用者。

Google 為 Gemini 4 Argon 公告發布的官方主視覺,深藍色資料點背景上是 Gemini 四角星標誌與 Gemini 4 字樣
Google 2026 年 9 月 30 日隨 Gemini 4 Argon 公告發布的官方主視覺。

Gemini 4 在 9 月 30 日落地,先給了資安團隊

Google 在 2026 年 9 月 30 日發布 Gemini 4,這一代的首款模型是 Gemini 4 Argon。這是 Google 自 2025 年 11 月 Gemini 3 系列以來第一個全新旗艦。中間這十個月屬於 Flash 系列與多模態變體,頂規模型的位置一直空著。

更不尋常的是開放順序。Argon 沒有直接對所有人亮在 Gemini 應用裡,Google 先把它交給 Fairwind 計畫中經過審核的資安防禦機構,做受控的早期開放。

公告把付費 API 客戶與 Google AI Ultra 訂閱用戶列為下一批,一般消費者完全沒有時間表。Google 的說法是,等安全護欄進一步完善之後再擴大範圍。

本文事實來自 Google 2026 年 9 月 30 日的公開公告,以及 10 月 1 日至 2 日的公開報導。

旗艦位置空了十個月

Gemini 3 Pro 發布於 2025 年 11 月。2026 年前九個月,Google 出貨的是 Flash 迭代、Windows 版 Gemini 應用、即時語音模型與代理程式影片理解,頂規那條線始終沒有動。同期 OpenAI 與 Anthropic 都在繼續推進各自的前沿模型。

2026 年 7 月 22 日,Sundar Pichai 在財報電話會議上說,下一次躍升需要更大的基座模型,並點名編碼與代理程式編碼是 Google 需要補上的差距。前一天,Google 自家的部落格已經確認 Gemini 4 的大規模預訓練正在進行。

組織層面也在換人。2026 年 8 月 Demis Hassabis 卸任 Google DeepMind 執行長,轉任 Alphabet 董事長兼首席科學家,Koray Kavukcuoglu 接任 DeepMind 負責人。9 月 24 日他說 Argon 已進入後訓練階段,希望遠早於 2026 年底發布。六天後模型就出來了。

  • Gemini 3 系列發布於 2025 年 11 月,比 Gemini 4 早十個月。
  • 編碼與代理程式編碼被點名為 Google 要補的差距。
  • 從後訓練表態到正式發布,只隔了六天。

18 項評測裡,Argon 單獨領先 12 項

Google 隨公告發布了跨模型對照表,Argon 對上 GPT-6 Astra、Claude Fable 5.1 與 Claude Opus 5.5。Argon 單獨領先 12 項,另有 1 項並列第一。GPT-6 Astra 單獨領先 3 項,Claude Opus 5.5 單獨領先 2 項。

領先面很廣,但不是全面壓制。在 FrontierSWE v2 與 Terminal-Bench Science 0.1 上,Argon 落後 GPT-6 Astra 10.5 個百分點;在 Terminal-bench 4.0 上落後 Claude Opus 5.5 九個百分點。下面這張表把最大的領先項與三項落後放在一起,差距都是算出來的,不是原文照搬。

評測Gemini 4 Argon最強對手差距
DeepSWE v1.1(長流程軟體工程)77.9%Claude Opus 5.5 74.2%領先 3.7 個百分點
LVBench(長影片理解)91.7%GPT-6 Astra 87.5%領先 4.2 個百分點
Harvey 法律智慧體基準19.6%Claude Fable 5.1 6.7%領先 12.9 個百分點
AutomationBench(端到端業務流程)51.3%Claude Opus 5.5 42.5%領先 8.8 個百分點
FrontierSWE v255.0%GPT-6 Astra 65.5%落後 10.5 個百分點
Terminal-bench 4.057.4%Claude Opus 5.5 66.4%落後 9 個百分點
Google 公告中的完整基準對照表,Gemini 4 Argon 與 GPT-6 Astra、Claude Fable 5.1、Claude Opus 5.5 在知識工作、代理程式編碼、機器學習工程、科學與數學、長上下文、電腦操作、多模態理解與網路安全八類評測上的得分
Google 隨 Gemini 4 Argon 公告發布的完整跨模型對照表,所有分數均為廠商自報。

這些數字全部來自 Google 自報。到目前為止,沒有任何第三方發布過完整重現,所以這張表應該讀成廠商的論證,而不是已經定論的排名。

Google 自己已經在生產環境裡跑 Argon

公告裡最有分量的內容不是跑分行,而是 Google 說這個模型在公司內部已經在做什麼。數千名員工用它做專項程式開發、深度研究與寫作。

量子運算團隊有一個子程式,成本用 qubits 與 gates 的乘積衡量。Argon 在數分鐘內找到了新的最佳化方案,比先前公開發表的基線提升 40%。

另一組 Argon 智慧體在分析 Google 資料中心的效能遙測資料,並自動執行記憶體最佳化。全部方案部署後,已經釋放超過 300 TiB 記憶體,Google 預計最終節省 500 TiB 到 1 PiB。

  • C/C++ 轉 Rust 的遷移涵蓋 re2、libgav1 與 Fuchsia Zircon 核心,超過 80 萬行程式碼。
  • 其中 libgav1 用安全 Rust 重寫了約 3.2 萬行 SIMD 程式碼。
  • 重寫後的解碼器影片輸出完全一致,比先前的 Rust 移植版快 2.7 倍。
Google 公告中的 DeepSWE v1.1 長條圖,Gemini 4 Argon 77.9%,GPT-6 Astra 74.1%,Claude Opus 5.5 74.2%,Claude Fable 5.1 67.4%
DeepSWE v1.1,Google 所述遷移工作背後的長流程軟體工程基準。

這些是 Google 自報的內部結果,不是獨立測量,公告裡也沒有給出外部稽核。

為什麼把資安防禦放在第一位

安全是 Google 選擇首先強化的方向。Argon 在 CWE-bench v1 上拿到 68%,並列第一,Google 說它能自主完成漏洞發現、驗證與修補。經過審核的防禦機構與內部團隊還能拿到一個放寬部分資安護欄的版本,用來呼叫更完整的防禦能力。

Google 旗下的雲端與 AI 安全平台 Wiz 已經在 Scan for Good 計畫裡使用 Argon,這個計畫為關鍵公共基礎設施提供免費安全掃描。早期示範中,Argon 發現了一個先前其他前沿模型沒能識別的嚴重漏洞,涉及全球多家醫院在用的醫療軟體。

把發布節奏壓住不是拖延,而是先把護欄建起來。Google 描述會從四個方向繼續加強限制,並部署一套執行時緩解機制,監控模型的思維鏈與實際動作,在任務偏離使用者意圖時中止執行。類似的監控也用於訓練過程,偵測到異常行為會向專門的事件回應團隊發出警報。Google 還盡量避免把監控結果直接回饋進訓練,以降低模型慢慢學會規避監控的風險。

Google 公告中的 CWE-bench v1 排行榜,涵蓋十一個模型,Gemini 4 Argon 以 68% 與 Grok 4.7、GPT-6 Astra 並列第一,Claude Opus 5.5 為 67%
CWE-bench v1,按 Pass@1 計分,並列時以 Pass@4 區分。
Google 公告中兩張安全漏洞發現圖表,真實漏洞發現 Gemini 4 Argon 85.8% 對 Gemini 3.8 Flash Cyber 71.0%,黑箱滲透測試基準 70.9 對 58.2
漏洞發現與黑箱滲透測試,兩項均由 Google 自報。

安全部分的資料同樣來自 Google 自報,滲透測試結果還沒有第三方重現。

早期價格低於同級競品

Google 公布的 API 早期價格是每百萬輸入 token 2 美元、每百萬輸出 token 10 美元,快取輸入再打 95% 折扣。早期優惠結束後回到 4 美元與 20 美元。消費級訂閱的價格沒有公布。

放在它自己那張對照表的模型裡比,早期檔是這幾家裡最便宜的,差距很大;即便按標準價,也只是與 Claude Opus 5.5 持平,並沒有更低。

模型輸入(每百萬 token)輸出(每百萬 token)
Gemini 4 Argon(早期價)2 美元10 美元
Gemini 4 Argon(標準價)4 美元20 美元
Claude Opus 5.54 美元20 美元
GPT-6 Astra10 美元50 美元

本站的計費以服務端即時報價為準,Star Task 帳本是最終記錄。本頁任何價格都不是本站的服務報價。

誰先用得上

取用按階段推進。Fairwind 合作夥伴第一批,然後是付費 API 客戶與 Google AI Ultra 訂閱用戶,最後才輪到開發者、企業與一般消費者。Gemini 應用免費層與 Pro 層都沒有公開日期。

在開放被卡住的這段時間,實用的做法沒有變。看 Google 公告取得方向,然後回到自己的工作臺核對真正能呼叫的模型。本站對話工作臺目前跑的是 Gemini 3.8 Flash,Gemini 4 狀態頁把已經公布的事實集中在一處。

常見問題

Gemini 4 是什麼時候發布的?

Google 在 2026 年 9 月 30 日發布 Gemini 4,首款模型是 Argon。這是繼 2025 年 11 月 Gemini 3 系列之後,Google 第一個全新的旗艦世代。

Argon 是 Gemini 4 唯一的模型嗎?

Argon 是目前 Google 唯一點名過的 Gemini 4 模型。這一代後續還會擴充,但暫時沒有第二款模型的公告。

現在能用上 Gemini 4 嗎?

一般使用者的 Gemini 應用還用不上。取用權限首先給到 Fairwind 計畫中經過審核的資安防禦機構,Google 沒有公布免費層與 Pro 層的開放日期。

Google 為什麼先開放給資安團隊?

Google 表示希望在更大範圍開放前進一步完善安全護欄。先交給經過審核的防禦方,可以讓模型投入真實的安全工作,同時繼續推進護欄與監控機制。

這些跑分是第三方獨立測的嗎?

不是。公告裡的每個數字都是 Google 自報,目前還沒有任何第三方發布過完整對照的重現結果。

Gemini 4 和 Gemini 3.8 Flash 有什麼差別?

Gemini 3.8 Flash 是目前最新的 Flash 模型,也是本站今天真正能呼叫的模型。Argon 是 Gemini 4 的旗艦,面向長流程任務,本站工作臺目前還沒有上架。

單次 100 萬 token 輸出意味著什麼?

一次回應最多可以輸出 100 萬個 token,先前是 6.4 萬。長重構、大遷移或長報告可以一次寫完,不必因為中途被截斷而分多次接續。

本站跑的是 Gemini 4 嗎?

不是。本站是獨立工作臺,以 Gemini 4 作為品牌名,與 Google 沒有關聯。模型列表中只顯示執行時真正可以呼叫的模型。

先試試今天能呼叫的模型

工作臺只列出帳號真正能呼叫的模型,每次請求前都會給出服務端報價。

進入對話工作臺