Story
Oktober 1, 2026
Google sagt, Gemini 4 Argon sei bereit für die KI-Spitze – doch die Öffentlichkeit muss warten
Google stellt den eingeschränkten Start von Gemini 4 Argon als verantwortungsvollen Umgang mit einem leistungsstarken Cyberabwehrwerkzeug dar, während externe Berichterstattung den Ausschluss der Öffentlichkeit als Erinnerung daran einordnet, dass Benchmarks und interne Behauptungen einer breiten Prüfung unter realen Bedingungen noch nicht standhalten mussten.
Googles Weg zu Gemini 4 Argon begann mit einem Fehlschlag. Im Mai hatte CEO Sundar Pichai eine große Modellveröffentlichung für Juni angekündigt, doch das erwartete Gemini 3.5 Pro erschien nie; stattdessen verbrachte Google den Sommer damit, günstigere Flash-Modelle zu veröffentlichen, während OpenAI und Anthropic weiter voranschritten.1
Am Mittwoch enthüllte Google schließlich Argon und bezeichnete es als Spitzenmodell für Softwareentwicklung, Unternehmensarbeit und Cyberabwehr. Das Unternehmen sagt, interne Teams hätten es für schwierige Programmier- und Forschungsarbeiten eingesetzt, und berichtet zugleich, Argon habe geholfen, mehr als 300 Tebibyte Rechenzentrumspeicher freizugeben und große Codebasen von C/C++ auf Rust zu migrieren.2
Googles Leistungsargument stützt sich stark auf Benchmarks: Das Unternehmen sagt, Argon habe bei DeepSWE v1.1 77,9 % erreicht und den Vals Index bei Aufgaben zur Wirtschaftsanalyse angeführt. Demis Hassabis bekräftigte die letztere Behauptung auf X und sagte, Gemini 4 Argon habe „den Platz Nr. 1 im Vals Index mit 68,9 %“ erreicht.
3 Das Unternehmen sagt außerdem, das Modell könne bis zu 1 Million Tokens erzeugen – weit mehr als das Limit von 64.000 Tokens früherer Gemini-Systeme.2
Der Start ist jedoch mit einer auffälligen Einschränkung verbunden: Fast niemand kann es nutzen. Google stellt Argon zunächst nur überprüften Regierungs- und Cybersicherheitspartnern über sein Fairwind Program zur Verfügung und nimmt zugleich am freiwilligen Vorabprüfungsverfahren der US-Regierung teil. Pichai sagte, das Modell verfüge über „Sicherheitsvorkehrungen auf Spitzenniveau“ und werde Nutzer erreichen, „sobald wir können und so sicher, wie wir können“.
4
Diese Vorsicht ist Googles Antwort auf das Risiko von Missbrauch, Prompt-Injection und Fehlalignment. Das Unternehmen sagt, es überwache die Gedankenkette des Modells und könne es anhalten, wenn es Grenzen überschreite. Der eingeschränkte Rollout verschiebt jedoch auch den wichtigsten Test: ob Argons Benchmark-Vorsprung im normalen Einsatz Bestand hat. Axios merkte an, dass anonyme Mitarbeiter Berichten zufolge die interne Leistung als mangelhaft empfunden hätten – eine Darstellung, die Google bestritt – und warnte, dass Modelle darauf trainiert werden könnten, in Tests hervorzuragen, ohne diese Stärke in der realen Welt zu erreichen.1
Vorerst hat Google das Rampenlicht zurückerobert, nicht unbedingt das Urteil. Eine breitere Verfügbarkeit wird nach weiteren Tests versprochen, zunächst für zahlende API-Kunden und AI-Ultra-Abonnenten, doch ein Datum wurde nicht genannt.5