Gemini 4 ist da: Argon läuft, und die meisten können es noch nicht nutzen
Gemini 4 ist Googles erste neue Flaggschiff-Generation seit der Gemini-3-Reihe im November 2025. Die Ankündigung vom 30. September nennt ein Modell, Argon, und übergibt es zuerst an Cyberverteidiger.
Gemini 4 landete am 30. September 2026
Google hat Gemini 4 am 30. September 2026 angekündigt, und das erste Modell der Generation ist Gemini 4 Argon. Es ist das erste neue Flaggschiff des Unternehmens seit der Gemini-3-Reihe im November 2025. Die zehn Monate dazwischen gehörten der Flash-Reihe und multimodalen Varianten, nicht einem neuen Spitzenmodell.
Ungewöhnlich ist vor allem die Reihenfolge des Zugangs. Argon wurde nicht für alle in der Gemini-App freigeschaltet. Google öffnete es zuerst für geprüfte Cyberverteidiger, über ein kontrolliertes Frühzugangsprogramm namens Fairwind.
Zahlende API-Kunden und Abonnenten von Google AI Ultra nennt die Ankündigung als nächste Gruppen, für Endnutzer gibt es gar kein Datum. Google zufolge folgt der breitere Rollout, sobald die Sicherheitsleitplanken weiter ausgearbeitet sind.
Die berichteten Fakten in diesem Artikel stammen aus Googles öffentlicher Ankündigung vom 30. September 2026 und der Berichterstattung vom 1. und 2. Oktober 2026.
Der Flaggschiff-Platz blieb zehn Monate leer
Gemini 3 Pro erschien im November 2025. In den ersten neun Monaten des Jahres 2026 lieferte Google Flash-Aktualisierungen, eine native Gemini-App für Windows, Live-Sprachmodelle und agentisches Videoverständnis, während die Spitze der Reihe unverändert blieb. OpenAI und Anthropic lieferten in diesem Fenster beide weiter Frontier-Modelle.
Am 22. Juli 2026 sagte Sundar Pichai gegenüber Analysten, der nächste Schritt nach oben brauche deutlich größere Basismodelle, und nannte Programmieren und agentisches Programmieren als Felder, in denen Google eine Lücke schließen müsse. Einen Tag zuvor hatte Googles eigener Blog bereits bestätigt, dass ein ehrgeiziger Pre-Training-Lauf für Gemini 4 lief.
Auch die Organisation änderte sich. Im August 2026 trat Demis Hassabis als CEO von Google DeepMind zurück und wurde Vorsitzender und Chefwissenschaftler von Alphabet, Koray Kavukcuoglu übernahm DeepMind. Am 24. September sagte er, Argon sei in die Post-Training-Phase eingetreten, und er hoffe auf einen Start deutlich vor Jahresende. Sechs Tage später war das Modell da.
- Die Gemini-3-Reihe erschien im November 2025, zehn Monate vor Gemini 4.
- Programmieren und agentisches Programmieren wurden als die Lücke genannt, die Google schließen musste.
- Zwischen der Aussage zur Post-Training-Phase und der Veröffentlichung lagen sechs Tage.
Zwölf Siege in achtzehn Benchmarks
Google hat mit der Ankündigung eine modellübergreifende Tabelle veröffentlicht, die Gemini 4 Argon mit GPT-6 Astra, Claude Fable 5.1 und Claude Opus 5.5 vergleicht. Argon führt zwölf Benchmarks direkt an und liegt bei einer weiteren gleichauf auf Platz eins. GPT-6 Astra gewinnt drei, Claude Opus 5.5 zwei.
Die Führung ist breit, aber nicht absolut. Bei FrontierSWE v2 und Terminal-Bench Science 0.1 liegt Argon 10,5 Punkte hinter GPT-6 Astra, bei Terminal-bench 4.0 neun Punkte hinter Claude Opus 5.5. Die folgende Tabelle stellt die größten Siege und die drei Niederlagen nebeneinander; die Abstände sind gerechnet, nicht zitiert.
| Benchmark | Gemini 4 Argon | Stärkster Rivale | Abstand |
|---|---|---|---|
| DeepSWE v1.1 (langlaufende Softwareentwicklung) | 77,9 % | Claude Opus 5.5 mit 74,2 % | 3,7 Punkte voraus |
| LVBench (Verständnis langer Videos) | 91,7 % | GPT-6 Astra mit 87,5 % | 4,2 Punkte voraus |
| Harvey's Legal Agent Benchmark | 19,6 % | Claude Fable 5.1 mit 6,7 % | 12,9 Punkte voraus |
| AutomationBench (durchgängige Geschäftsprozesse) | 51,3 % | Claude Opus 5.5 mit 42,5 % | 8,8 Punkte voraus |
| FrontierSWE v2 | 55,0 % | GPT-6 Astra mit 65,5 % | 10,5 Punkte zurück |
| Terminal-bench 4.0 | 57,4 % | Claude Opus 5.5 mit 66,4 % | 9 Punkte zurück |
Jede Zahl hier ist Googles eigenes gemeldetes Ergebnis. Bislang hat kein unabhängiger Dritter die vollständige Vergleichstabelle nachgerechnet; lies die Tabelle daher als Argumentation des Anbieters, nicht als gesetztes Ranking.
Google betreibt Argon bereits in der eigenen Infrastruktur
Der konkreteste Beleg in der Ankündigung ist keine Benchmark-Zeile, sondern das, was das Modell laut Google bereits im Unternehmen leistet, wo Tausende Beschäftigte es für spezialisiertes Programmieren, tiefe Recherche und Textarbeit nutzen.
Ein Team für Quantencomputing hatte eine Unterroutine, deren Kosten sich als Produkt aus Qubits und Gattern messen. Argon fand innerhalb von Minuten eine neue Optimierung, die den zuvor veröffentlichten Basiswert um 40 Prozent schlug.
Ein zweiter Einsatz analysierte Leistungstelemetrie aus Googles Rechenzentren und führte Speicheroptimierungen automatisch aus. Mit allen Änderungen im Einsatz meldet Google mehr als 300 TiB freigegebenen Speicher und erwartet langfristig Einsparungen zwischen 500 TiB und 1 PiB.
- Die Migration von C und C++ nach Rust umfasst re2, libgav1 und den Fuchsia-Zircon-Kernel, mehr als 800.000 Zeilen Code.
- Für libgav1 hat Argon rund 32.000 Zeilen SIMD-Code in sicheres Rust übertragen.
- Der neu geschriebene Decoder liefert identische Videoausgabe und läuft 2,7-mal schneller als der frühere Rust-Port.
Das sind interne, von Google gemeldete Ergebnisse und keine unabhängigen Messungen; eine externe Prüfung nennt die Ankündigung nicht.
Warum die Cyberverteidigung zuerst kam
Sicherheit ist die Fähigkeit, mit der Google vorangeht. Argon erreicht 68 Prozent bei CWE-bench v1, gleichauf mit Platz eins, und Google zufolge findet, prüft und behebt es Schwachstellen selbstständig. Geprüfte Verteidiger und interne Teams erhalten eine Version mit gelockerten Sicherheitsleitplanken, um die volle defensive Fähigkeit zu erreichen.
Wiz, Googles Plattform für Cloud- und KI-Sicherheit, setzt Argon bereits im Programm Scan for Good ein, das kritische öffentliche Infrastruktur kostenlos prüft. In einer frühen Demonstration fand das Modell eine schwere Schwachstelle in medizinischer Software, die weltweit in Krankenhäusern läuft und die frühere Frontier-Modelle übersehen hatten.
Die Veröffentlichung zurückzuhalten ist der Punkt und keine Verzögerung um ihrer selbst willen. Google beschreibt vier Richtungen der Leitplanken-Arbeit und eine Laufzeit-Milderungsschicht, die Denkweise und Handlungen des Modells beobachtet und eine Aufgabe stoppt, wenn sie vom Nutzerwillen abweicht. Eine vergleichbare Überwachung läuft auch im Training, und auffälliges Verhalten löst eine Warnung an ein eigenes Incident-Response-Team aus. Google vermeidet es zudem, diese Überwachung zurück ins Training zu speisen, damit das Modell nicht langsam lernt, sie zu umgehen.
Auch die Sicherheitszahlen sind vom Anbieter gemeldet, und kein Dritter hat das Penetrationstest-Ergebnis reproduziert.
Der Einführungspreis unterbietet die nächsten Rivalen
Google nannte Einführungspreise für die API von 2 US-Dollar pro Million Eingabe-Token und 10 US-Dollar pro Million Ausgabe-Token, mit 95 Prozent Rabatt auf zwischengespeicherte Eingabe. Die Standardpreise nach der Einführungsphase steigen auf 4 und 20 Dollar. Preise für Endkunden-Tarife wurden nicht angekündigt.
Gegen die veröffentlichten Preise der Modelle in der eigenen Vergleichstabelle ist die Einführungsstufe mit deutlichem Abstand die günstigste der Gruppe, und selbst die Standardstufe erreicht Claude Opus 5.5 nur, statt es zu unterbieten.
| Modell | Eingabe pro Million Token | Ausgabe pro Million Token |
|---|---|---|
| Gemini 4 Argon (Einführung) | 2 USD | 10 USD |
| Gemini 4 Argon (Standard) | 4 USD | 20 USD |
| Claude Opus 5.5 | 4 USD | 20 USD |
| GPT-6 Astra | 10 USD | 50 USD |
Kosten entstehen auf dieser Seite immer aus dem eigenen serverseitigen Angebot, und das Star-Task-Ledger ist der abschließende Abrechnungsbeleg. Kein Preis auf dieser Seite ist ein Angebot für hier erbrachte Arbeit.
Wer wann hineinkommt
Der Zugang verläuft in Phasen. Fairwind-Partner zuerst, dann zahlende API-Kunden und Abonnenten von Google AI Ultra, und erst danach Entwickler, Unternehmen und Endnutzer, sobald Google die Sicherheitsarbeit abschließt. Für die kostenlose Stufe und Pro der Gemini-App gibt es kein öffentliches Datum.
Solange der Rollout begrenzt ist, ändert sich die nützliche Gewohnheit nicht. Lies die Ankündigung für die Richtung und prüfe dann, was dein eigener Arbeitsbereich tatsächlich aufrufen kann. Gemini 3.8 Flash ist das Modell, das der Chat-Arbeitsbereich dieser Seite heute ausführt, und die Statusseite sammelt alle angekündigten Gemini-4-Fakten an einer Stelle.
Häufige Fragen
Wann wurde Gemini 4 veröffentlicht?
Google hat Gemini 4 und das erste Modell Argon am 30. September 2026 angekündigt. Es ist die erste neue Flaggschiff-Generation seit der Gemini-3-Reihe im November 2025.
Ist Argon das einzige Gemini-4-Modell?
Argon ist das einzige Gemini-4-Modell, das Google bisher benannt hat. Die Generation dürfte wachsen, weitere Modelle sind aber nicht angekündigt.
Kann ich Gemini 4 heute nutzen?
Nicht über die Gemini-App für Endnutzer. Der Zugang begann mit geprüften Cyberverteidigern im Fairwind-Programm, und für die kostenlose Stufe und Pro hat Google kein öffentliches Startdatum genannt.
Warum beginnt Google bei Cyberverteidigern?
Google will die Sicherheitsleitplanken weiter ausarbeiten, bevor das Modell breit verfügbar wird. Mit geprüften Verteidigern kann das Modell an echten Sicherheitsproblemen arbeiten, während diese Arbeit weiterläuft.
Sind die Benchmark-Zahlen unabhängig?
Nein. Jede Zahl in der Ankündigung ist von Google gemeldet, und bislang hat kein Dritter die vollständige Vergleichstabelle nachgerechnet.
Worin unterscheidet sich Gemini 4 von Gemini 3.8 Flash?
Gemini 3.8 Flash ist das neueste Flash-Modell und das einzige, das diese Seite heute aufrufen kann. Argon ist das Gemini-4-Flaggschiff für langlaufende Aufgaben und steht in diesem Arbeitsbereich noch nicht zur Verfügung.
Was ändert ein Ausgabelimit von 1 Mio. Token?
Eine einzelne Antwort kann jetzt bis zu 1.000.000 Token statt 64.000 enthalten, sodass ein langes Refactoring, eine Migration oder ein Bericht in einem Durchgang fertig werden, statt mittendrin abzubrechen.
Läuft diese Seite auf Gemini 4?
Nein. Dies ist ein unabhängiger Arbeitsbereich, der den Namen Gemini 4 als Marke nutzt und nicht mit Google verbunden ist. Die Modellauswahl zeigt nur Modelle, die zur Laufzeit tatsächlich aufgerufen werden können.
Beginne mit dem, was du heute aufrufen kannst
Der Arbeitsbereich zeigt nur Modelle, die dein Konto tatsächlich aufrufen kann, mit einem serverseitigen Angebot vor jeder Anfrage.
Chat-Arbeitsbereich öffnen