Gemini 4 正式发布:首款模型 Argon 上线,但多数人还用不上
Gemini 4 是谷歌自 2025 年 11 月 Gemini 3 系列以来第一个全新旗舰代际。2026 年 9 月 30 日的公告只点名了一款模型 Argon,而且没有先给普通用户。
Gemini 4 在 9 月 30 日落地,先给了安全团队
谷歌在 2026 年 9 月 30 日发布 Gemini 4,这一代的首款模型是 Gemini 4 Argon。这是谷歌自 2025 年 11 月 Gemini 3 系列以来第一个全新旗舰。中间这十个月属于 Flash 系列和多模态变体,顶配模型的位置一直空着。
更不寻常的是开放顺序。Argon 没有直接对所有人亮在 Gemini 应用里,谷歌先把它交给 Fairwind 项目中经过审核的网络安全防御机构,做受控的早期访问。
公告把付费 API 客户和 Google AI Ultra 订阅者列为下一批,普通消费者完全没有时间表。谷歌的说法是,等安全护栏进一步完善之后再扩大范围。
本文事实来自谷歌 2026 年 9 月 30 日的公开公告,以及 10 月 1 日至 2 日的公开报道。
旗舰位置空了十个月
Gemini 3 Pro 发布于 2025 年 11 月。2026 年前九个月,谷歌出货的是 Flash 迭代、Windows 版 Gemini 应用、实时语音模型和 agentic 视频理解,顶配那条线始终没有动。同期 OpenAI 和 Anthropic 都在继续推进各自的前沿模型。
2026 年 7 月 22 日,Sundar Pichai 在财报电话会上说,下一次跃升需要更大的基座模型,并点名编码和 agentic coding 是谷歌需要补上的差距。前一天,谷歌自己的博客已经确认 Gemini 4 的大规模预训练已经开始。
组织层面也在换人。2026 年 8 月 Demis Hassabis 卸任 Google DeepMind CEO,转任 Alphabet 董事长兼首席科学家,Koray Kavukcuoglu 接任 DeepMind 负责人。9 月 24 日他说 Argon 已进入 post-training,希望远早于 2026 年底发布。六天后模型就出来了。
- Gemini 3 系列发布于 2025 年 11 月,比 Gemini 4 早十个月。
- 编码和 agentic coding 被点名为谷歌要补的差距。
- 从 post-training 表态到正式发布,只隔了六天。
18 项评测里,Argon 单独领先 12 项
谷歌随公告发布了跨模型对照表,Argon 对 GPT-6 Astra、Claude Fable 5.1 和 Claude Opus 5.5。Argon 单独领先 12 项,另有 1 项并列第一。GPT-6 Astra 单独领先 3 项,Claude Opus 5.5 单独领先 2 项。
领先面很广,但不是全面压制。在 FrontierSWE v2 和 Terminal-Bench Science 0.1 上,Argon 落后 GPT-6 Astra 10.5 个百分点;在 Terminal-bench 4.0 上落后 Claude Opus 5.5 九个百分点。下面这张表把最大的领先项和三项落后放在一起,差距都是算出来的,不是原文照搬。
| 评测 | Gemini 4 Argon | 最强对手 | 差距 |
|---|---|---|---|
| DeepSWE v1.1(长流程软件工程) | 77.9% | Claude Opus 5.5 74.2% | 领先 3.7 个百分点 |
| LVBench(长视频理解) | 91.7% | GPT-6 Astra 87.5% | 领先 4.2 个百分点 |
| Harvey 法律智能体基准 | 19.6% | Claude Fable 5.1 6.7% | 领先 12.9 个百分点 |
| AutomationBench(端到端业务流) | 51.3% | Claude Opus 5.5 42.5% | 领先 8.8 个百分点 |
| FrontierSWE v2 | 55.0% | GPT-6 Astra 65.5% | 落后 10.5 个百分点 |
| Terminal-bench 4.0 | 57.4% | Claude Opus 5.5 66.4% | 落后 9 个百分点 |
这些数字全部来自谷歌自报。到目前为止,没有任何第三方发布过完整复现,所以这张表应该读成厂商的论证,而不是已经定论的排名。
谷歌自己已经在生产环境里跑 Argon
公告里最有分量的内容不是跑分行,而是谷歌说这个模型在公司内部已经在做什么。数千名员工用它做专项编程、深度研究和写作。
量子计算团队有一个子程序,成本用 qubits 与 gates 的乘积衡量。Argon 在数分钟内找到了新的优化方案,比此前公开发表的基线提升 40%。
另一组 Argon 智能体在分析谷歌数据中心的性能遥测数据,并自动执行内存优化。全部方案部署后,已经释放超过 300 TiB 内存,谷歌预计最终节省 500 TiB 到 1 PiB。
- C/C++ 转 Rust 的迁移覆盖 re2、libgav1 和 Fuchsia Zircon 内核,超过 80 万行代码。
- 其中 libgav1 用安全 Rust 重写了约 3.2 万行 SIMD 代码。
- 重写后的解码器视频输出完全一致,比此前的 Rust 移植版快 2.7 倍。
这些是谷歌自报的内部结果,不是独立测量,公告里也没有给出外部审计。
为什么把网络安全放在第一位
安全是谷歌选择首先强化的方向。Argon 在 CWE-bench v1 上拿到 68%,并列第一,谷歌说它能自主完成漏洞发现、验证和修复。经过审核的防御机构和内部团队还能拿到一个放宽部分网络安全护栏的版本,用来调用更完整的防御能力。
谷歌旗下云与 AI 安全平台 Wiz 已经在 Scan for Good 项目里使用 Argon,这个项目为关键公共基础设施提供免费安全扫描。早期演示中,Argon 发现了一个此前其他前沿模型没能识别的严重漏洞,涉及全球多家医院在用的医疗软件。
把发布节奏压住不是拖延,而是先把护栏建起来。谷歌描述会从四个方向继续加强限制,并部署一套运行时缓解机制,监控模型的思维链和实际动作,在任务偏离用户意图时中止执行。类似的监控也用于训练过程,检测到异常行为会向专门的事件响应团队发出警报。谷歌还尽量避免把监控结果直接反馈进训练,以降低模型慢慢学会规避监控的风险。
安全部分的数据同样来自谷歌自报,渗透测试结果还没有第三方复现。
早期价格低于同级竞品
谷歌公布的 API 早期价格是每百万输入 token 2 美元、每百万输出 token 10 美元,缓存输入再打 95% 折扣。早期优惠结束后回到 4 美元和 20 美元。消费级订阅的价格没有公布。
放在它自己那张对照表的模型里比,早期档是这几家里最便宜的,差距很大;即便按标准价,也只是与 Claude Opus 5.5 持平,并没有更低。
| 模型 | 输入(每百万 token) | 输出(每百万 token) |
|---|---|---|
| Gemini 4 Argon(早期价) | 2 美元 | 10 美元 |
| Gemini 4 Argon(早期优惠后) | 4 美元 | 20 美元 |
| Claude Opus 5.5 | 4 美元 | 20 美元 |
| GPT-6 Astra | 10 美元 | 50 美元 |
本站的计费以服务端实时报价为准,Star Task 账本是最终记录。本页任何价格都不是本站的服务报价。
谁先用得上
访问按阶段推进。Fairwind 合作伙伴第一批,然后是付费 API 客户和 Google AI Ultra 订阅者,最后才轮到开发者、企业和普通消费者。Gemini 应用免费层和 Pro 层都没有公开日期。
在开放被卡住的这段时间,实用的做法没有变。看谷歌公告获取方向,然后回到自己的工作台核对真正能调用的模型。本站聊天工作台目前跑的是 Gemini 3.8 Flash,Gemini 4 状态页把已经公布的事实集中在一处。
常见问题
Gemini 4 是什么时候发布的?
谷歌在 2026 年 9 月 30 日发布 Gemini 4,首款模型是 Argon。这是继 2025 年 11 月 Gemini 3 系列之后,谷歌第一个全新的旗舰代际。
Argon 是 Gemini 4 唯一的模型吗?
Argon 是目前谷歌唯一点名过的 Gemini 4 模型。这一代后续还会扩充,但暂时没有第二款模型的公告。
现在能用上 Gemini 4 吗?
普通用户的 Gemini 应用还用不上。访问权限首先给到 Fairwind 项目中经过审核的网络安全防御机构,谷歌没有公布免费层和 Pro 层的开放日期。
谷歌为什么先开放给网络安全团队?
谷歌表示希望在更大范围开放前进一步完善安全护栏。先交给经过审核的防御方,可以让模型投入到真实的安全工作中,同时继续推进护栏与监控机制。
这些跑分是第三方独立测的吗?
不是。公告里的每个数字都是谷歌自报,目前还没有任何第三方发布过完整对照的复现结果。
Gemini 4 和 Gemini 3.8 Flash 有什么区别?
Gemini 3.8 Flash 是目前最新的 Flash 模型,也是本站今天真正能调用的模型。Argon 是 Gemini 4 的旗舰,面向长流程任务,本站工作台目前还没有上架。
单次 100 万 token 输出意味着什么?
一次响应最多可以输出 100 万个 token,此前是 6.4 万。长重构、大迁移或者长报告可以一次写完,不必因为中途被截断而分多次接续。
本站跑的是 Gemini 4 吗?
不是。本站是独立工作台,以 Gemini 4 作为品牌名,与谷歌没有关联。模型列表中只显示运行时真正可以调用的模型。