In den News / Modell-Ankündigung

Gemini 4 Argon: starke Benchmarks, aber noch kein allgemeiner Zugang

Google hat am 30. September Gemini 4 Argon vorgestellt. Das Modell soll längere Arbeitsabläufe beim Programmieren und bei anspruchsvoller Wissensarbeit bewältigen. Für die meisten Leser ist zunächst der Zugang entscheidend: Die Ankündigung bedeutet noch keine allgemeine Freischaltung in der Gemini-App.

Wer kann Argon jetzt nutzen?

Zum Start erhalten ausgewählte Sicherheitspartner Zugriff über Googles Fairwind Program. Das Programm richtet sich unter anderem an Behörden, Betreiber kritischer Infrastruktur und große Technologieplattformen. Bewerber werden geprüft; ein gewöhnliches Google-Konto ersetzt diese Freigabe nicht.

Ein breiterer Start soll folgen, zunächst für zahlende API-Kunden und Google-AI-Ultra-Abonnenten. Google nennt im Launch-Beitrag dafür keinen festen Termin. Ein bestätigter allgemeiner Start in Deutschland lässt sich daraus noch nicht ableiten. Unsere Einordnung: Ein Abo allein in Erwartung von Argon aufzuwerten, wäre verfrüht.

Die API-Preise haben eine zweite Stufe

Google kündigt einen Einführungspreis von 2 USD je Million Eingabe-Token und 10 USD je Million Ausgabe-Token an. Danach sollen 4 beziehungsweise 20 USD gelten. Wie lange die Einführungsphase dauert, steht dort nicht. Das sind angekündigte API-Preise, keine deutschen Abo- oder Checkout-Preise. Wer einen dauerhaften Arbeitsablauf plant, sollte deshalb auch mit der zweiten Preisstufe rechnen.

Argon erhält außerdem ein Ausgabelimit von bis zu einer Million Token. Das beschreibt eine Obergrenze, keinen üblichen Verbrauch pro Antwort. Lange Ausgaben können bei nutzungsabhängiger Abrechnung teuer werden. Unser Ratgeber zu Abos, Credits und KI-Kosten erklärt, welche Kosten du vor einem Wechsel auseinanderhalten solltest.

Was die Originalgrafik tatsächlich zeigt

Googles originale Benchmark-Tabelle für Gemini 4 Argon, GPT-6 Astra, Claude Fable 5.1 und Claude Opus 5.5. Je nach Test führen unterschiedliche Modelle.
Originalgrafik aus dem Post von @GoogleDeepMind vom 30.09.2026, 22:03 Uhr MESZ. Vom Anbieter zusammengestellte Ergebnisse, kein ToolVergleiche-Test. Die Methodik und Grenzen ordnen wir darunter ein.Originalgrafik: Google DeepMind · Originalpost auf X ↗Bild in voller Größe öffnen ↗

Bei DeepSWE v1.1 nennt Google für Argon 77,9 Prozent, gegenüber 74,1 Prozent für GPT-6 Astra. Im Terminal-Bench 4.0 liegen dagegen Argons 57,4 Prozent unter den 66,4 Prozent von Claude Opus 5.5. Schon diese beiden Zeilen zeigen: Verschiedene Tests können verschiedene Sieger ergeben. Die Prozentwerte beschreiben Ergebnisse im jeweiligen Test, keine allgemeine Erfolgsquote für deine Arbeit.

Auch die Einstellungen zählen. Laut Methodik läuft Argon grundsätzlich mit der höchsten Denkstufe; Ausnahmen werden separat beschrieben. Den DeepSWE-Wert hat Google mit einer bestimmten Agenten-Software selbst ermittelt, Konkurrenzwerte stammen aus Ranglisten und Modellberichten. Die Tabelle belegt damit keinen Vergleich bei gleichem Zeit- oder Kostenbudget.

Was du daraus für deinen Alltag mitnehmen kannst

Interessant wird Argon, wenn dein verfügbarer Zugang, die tatsächlichen Kosten und die Qualität bei deiner Aufgabe zusammenpassen. Bis dahin kannst du drei wiederkehrende Aufgaben sammeln: etwa einen Fehler beheben, Unterlagen zusammenfassen und einen Entwurf überarbeiten. Vergleiche später dieselben Eingaben und notiere Nacharbeit, Laufzeit und Verbrauch. Das ist ein Vorschlag für einen eigenen Test, kein von uns gemessenes Ergebnis.

Wenn du heute einen Assistenten suchst, helfen die Profile von ChatGPT und Claude sowie unser Vergleich für Text- und Rechercheaufgaben. Eine neue Benchmark-Spitze allein beantwortet noch nicht, welches Werkzeug zu deinem Alltag passt.

Vom Release zur Praxis

Hier kannst du weiterlesen

Quellen & Aktualität

Tarife und Funktionen können sich ändern. Hier siehst du, auf welche Originalquellen sich die Angaben stützen und wann wir sie geprüft haben.

  1. Google: Gemini 4 Argon – Ankündigung, Zugang und Preise ↗ (öffnet einen neuen Tab)Ankündigung vom 30.09.2026 durch Koray Kavukcuoglu. Zunächst ausgewählte Fairwind-Partner, später breiterer Rollout beginnend mit zahlenden API-Kunden und AI-Ultra-Abonnenten, ohne festen Starttermin. Angekündigte API-Einführungspreise 2/10 USD pro Million Eingabe-/Ausgabe-Token, danach 4/20 USD; kein Ende der Einführungsphase genannt. Ausgabelimit bis 1M Token, kein typischer Verbrauch oder Abo-Preis.Geprüft am 1. Oktober 2026
  2. Google DeepMind: Fairwind Program und Zugangsbedingungen ↗ (öffnet einen neuen Tab)Geprüfter Zugang für vertrauenswürdige Sicherheitspartner, unter anderem Behörden, kritische Infrastruktur und Technologieplattformen. Keine allgemeine Freischaltung durch ein gewöhnliches Google-Konto; Bewerbungen werden geprüft.Geprüft am 1. Oktober 2026
  3. Google DeepMind: Gemini 4 Argon – veröffentlichte Benchmark-Werte ↗ (öffnet einen neuen Tab)Herstellerzusammenstellung: DeepSWE v1.1 Argon 77,9 %, GPT-6 Astra 74,1 %; Terminal-Bench 4.0 Argon 57,4 %, Claude Opus 5.5 66,4 %. Unterschiedliche Tests ergeben unterschiedliche Rangfolgen; keine eigene Leistungsmessung.Geprüft am 1. Oktober 2026
  4. Google DeepMind: Argon-Methodik und Modelleinstellungen (PDF) ↗ (öffnet einen neuen Tab)Offizielles PDF gelesen: Argon grundsätzlich höchste Denkstufe und pass@1, sofern nicht anders angegeben. DeepSWE selbst mit mini-swe-Agent berechnet; Konkurrenzwerte aus Ranglisten und System Cards, höchste berichtete Punktzahl/Denkstufe. Terminal-Bench: Argon selbst berechnet, Konkurrenzwerte aus offizieller Rangliste. Kein belegter Vergleich bei identischem Zeit- oder Kostenbudget.Geprüft am 1. Oktober 2026
  5. Google DeepMind auf X: Originalankündigung und Benchmark-Grafik ↗ (öffnet einen neuen Tab)Originalpost vom 30.09.2026, 20:03:30 UTC / 22:03:30 MESZ. Autor, Datum, Text und Original-PNG per X API MCP abgerufen. Post und vergrößertes Bild im angemeldeten Browser geprüft; unveränderte Originaldatei auch lokal visuell kontrolliert. Kein Screenshot mit privater Kontooberfläche, keine selbst erstellte Benchmark-Tabelle.Geprüft am 1. Oktober 2026
Diese Seite beruht auf redaktioneller Recherche mit KI-Unterstützung. Die vorgeschlagenen Aufgaben sind Hilfen für deinen eigenen Vergleich; wir weisen sie nicht als selbst durchgeführte Produkttests aus. So arbeiten wir · Fehler melden
Dein kleiner Tool-Kompass

1 von 2 · Deine Aufgabe

Was möchtest du machen?

Eine kleine Auswahl ist oft der beste Anfang.

Zwei Filter, kein KI-Chat. Deine Antworten werden nicht gespeichert.