Gemini 4 Argon: Googles Modell jagt Sicherheitslücken
Google bringt Argon zuerst zu Cyberverteidigern im Fairwind-Programm, mit 1 Million Output-Token und 68 Prozent auf CWE-bench v1.
Kurz gesagt
Gemini 4 Argon ist Googles neues Frontier-Modell, das Sicherheitslücken eigenständig finden, bestätigen und patchen soll, zunächst aber nur ausgewählten Cyberverteidigern im Fairwind-Programm offensteht.
Auf einen Blick
- Output-Limit: 1 Million Token statt bisher 64.000.
- Einführungspreis: 2 US-Dollar pro Million Input-Token, 10 US-Dollar pro Million Output-Token; danach 4 und 20 US-Dollar.
- CWE-bench v1: 68 Prozent, laut Google geteilter erster Platz beim Schließen von Schwachstellen.
- Terminal-Bench 4.0: 57,4 Prozent und Platz fünf, hinter Claude Sonnet 5.5 mit 70,6 Prozent (heise online).
- Start über das Fairwind-Programm; API-Kunden und Google AI Ultra sollen folgen, ein Datum nennt Google nicht.
Google hat am 30. September 2026 Gemini 4 Argon vorgestellt. Das Modell soll Sicherheitslücken eigenständig finden, bestätigen und schließen. Breit verfügbar ist es nicht: Zugang erhalten zuerst ausgewählte Cyberverteidiger über das Fairwind-Programm, API-Kunden und Abonnenten von Google AI Ultra sollen danach folgen.
Was technisch neu ist
Das auffälligste Merkmal ist die Ausgabelänge. Argon darf bis zu 1 Million Token ausgeben, bisher waren 64.000 das Limit. Für die Einführungsphase nennt Google 2 US-Dollar pro Million Input-Token und 10 US-Dollar pro Million Output-Token, gecachte Input-Token kosten 95 Prozent weniger. Danach steigen die Preise laut Google auf 4 beziehungsweise 20 US-Dollar.
Inhaltlich zielt das Modell auf drei Felder: Software-Engineering, Wissensarbeit in Recht und Finanzen sowie Cyberabwehr. Als Autor des Blogbeitrags zeichnet Koray Kavukcuoglu, SVP bei Google DeepMind.
Starke Benchmarks, selektiv ausgewählt
Google führt 77,9 Prozent auf DeepSWE v1.1 an, 51,3 Prozent auf AutomationBench, 91,7 Prozent auf LVBench zum Verständnis langer Videos und 68 Prozent auf CWE-bench v1, wo das Unternehmen einen geteilten ersten Platz beansprucht. Auch beim Vals Index, bei Vals Finance Agent v2, beim Legal-Agent-Benchmark von Harvey und bei Gray Swan IPI zur Prompt-Injection-Robustheit sieht Google sich vorn.
heise online ordnet diese Auswahl ein: Google lässt die schwächeren Werte weg. Auf Terminal-Bench 4.0 erreicht Argon demnach 57,4 Prozent und landet nur auf Platz fünf, hinter Claude Sonnet 5.5 mit 70,6 Prozent, Claude Opus 5.5 mit 66,4 Prozent, GPT-6 Astra mit 58,2 Prozent und Claude Fable 5.1 mit 57,9 Prozent. Auch auf FrontierSWE v2 (55,0 gegen 65,5 Prozent), Terminal-Bench Science 0.1 (57,6 gegen 68,1 Prozent) und OSWorld-2.0 (69,2 gegen 72,6 Prozent) liegt GPT-6 Astra vor Argon.
Googles eigene Einsatzzahlen
Intern will Google mit dem Modell eine veröffentlichte Referenz bei der Optimierung von Quantenalgorithmen um 40 Prozent übertroffen haben. Über 300 TiB Speicher seien freigeworden, geschätzt seien 500 TiB bis 1 PiB möglich. Beim Portieren von C- und C++-Code nach Rust nennt Google den Fuchsia-Kernel Zircon mit über 800.000 Zeilen, beim Video-Decoder libgav1 sollen 32.000 Zeilen SIMD-Code ersetzt und dabei eine 2,7-fach höhere Geschwindigkeit als bei der Rust-Portierung erreicht worden sein.
Diese Werte stammen ausschließlich von Google und sind bislang nicht unabhängig nachgemessen. Da Argon öffentlich nicht testbar ist, lässt sich auch die Benchmark-Tabelle derzeit von außen nicht nachvollziehen.
Sicherheit, Freigabe und offene Punkte
Für autorisierte Sicherheitsfachleute will Google das Modell ohne die üblichen Cyber-Schutzschranken anbieten. Als Schutzmaßnahmen nennt das Unternehmen überwachte Gedankenketten gegen Prompt Injection, Red-Teaming gegen Missbrauch, Monitoring auf Fehlausrichtung und abgeschottete Sandboxes vor Hochrisiko-Tests. Das Modell durchlaufe außerdem das freiwillige Vorab-Prüfverfahren der US-Regierung.
Als Praxisbeispiel nennt Google den Sicherheitsanbieter Wiz, der Argon in der Initiative Scan for Good einsetzt und damit eine kritische Lücke in weltweit genutzter Krankenhaus-Software gefunden haben will, über die sensible persönliche Daten offenlagen. heise online erinnert daran, dass eine Fehlkonfiguration bei Gemini zuvor unbeabsichtigt Zugriff auf echte Unternehmenssysteme ermöglicht hatte. Ein Datum für die allgemeine Verfügbarkeit nennt Google nicht, sondern nur die Absicht, so schnell wie möglich zu öffnen.
Häufige Fragen
Kann ich Gemini 4 Argon schon benutzen?
Nein. Der Zugang läuft zunächst über das Fairwind-Programm für geprüfte Cyberverteidiger. API-Kunden und Abonnenten von Google AI Ultra sollen danach folgen, ein Datum nennt Google nicht.
Was kostet Gemini 4 Argon?
In der Einführungsphase 2 US-Dollar pro Million Input-Token und 10 US-Dollar pro Million Output-Token, gecachte Input-Token 95 Prozent günstiger. Danach nennt Google 4 und 20 US-Dollar.
Ist Argon besser als GPT-6 Astra und Claude?
Nicht durchgehend. Argon führt bei DeepSWE v1.1, AutomationBench, LVBench und CWE-bench v1, liegt aber auf Terminal-Bench 4.0 mit 57,4 Prozent nur auf Platz fünf.