Story
Oktober 1, 2026

Google bezeichnet Gemini 4 Argon als Durchbruch – doch die Öffentlichkeit kann es noch immer nicht testen

Google präsentiert Gemini 4 Argon als sicherheitsbewusste Rückkehr an die KI-Spitze, während externe Berichterstattung ein Modell mit beeindruckenden Behauptungen, aber nur begrenzt verfügbaren Belegen für eine unabhängige Prüfung sieht. Seine eingeschränkte Einführung macht Vorsicht zu einem Teil von Googles Argumentation – und zum zentralen Grund, weshalb die Behauptungen unbewiesen bleiben.

Google hatte für Juni die Veröffentlichung eines bedeutenden Modells versprochen, bei dem weithin Gemini 3.5 Pro erwartet wurde. Diese Veröffentlichung erfolgte nie, nachdem das Unternehmen stattdessen über einen Zeitraum hinweg kleinere Flash-Modelle herausbrachte, während OpenAI und Anthropic voranschritten. Berichten zufolge folgte die Verzögerung auf interne Bedenken hinsichtlich Leistung und Moral, wodurch sich die Bedeutung von Googles nächstem Flaggschiff verschärfte.

Am Mittwoch stellte Google Gemini 4 Argon vor und bezeichnete es als Spitzenmodell für Softwareentwicklung, komplexe Wissensarbeit und Cyberabwehr. Vorstandschef Sundar Pichai sagte, Google-Teams nutzten es bereits intensiv, und beschrieb „Spitzenleistung in komplexen Arbeitsabläufen, Cyberabwehr und Softwareentwicklung“.

Googles Argumentation stützt sich sowohl auf den internen Einsatz als auch auf Benchmarks. Das Unternehmen sagt, Argon habe dabei geholfen, 300 TiB Speicher in Rechenzentren freizugeben und große C/C++-Codebasen auf Rust zu migrieren; außerdem verwies es auf ein Ergebnis von 77,9 % beim Softwareentwicklungs-Benchmark DeepSWE v1.1, vor namentlich genannten Rivalen. Das Unternehmen hat jedoch weder API-Preise noch einen Termin für die öffentliche Einführung bekannt gegeben, sodass Entwickler diese Ergebnisse nicht unabhängig reproduzieren können.

Die Zurückhaltung ist laut Google beabsichtigt. Argon wird zunächst über sein Fairwind-Programm an teilnehmende Behörden und geprüfte Cyberverteidiger gehen, während das Unternehmen Schutzmaßnahmen gegen Missbrauch, Prompt-Injection und Fehlanpassung verstärkt. DeepMind-Chef Demis Hassabis bezeichnete die Entscheidung als verantwortungsvolle gestaffelte Veröffentlichung „vor einer breiteren Verfügbarkeit“.

Dieser Ansatz hat zwei Seiten. Google sagt, er spiegele die Gefahren eines Modells wider, das in der Lage ist, schwerwiegende Softwarefehler zu identifizieren und zu beheben; Skeptiker weisen darauf hin, dass beeindruckende Benchmarks nicht klären, wie ein Modell unter unübersichtlichen Bedingungen in der realen Welt abschneidet. Axios berichtete, anonyme Mitarbeiter hätten Aspekte der internen Tests als unzureichend empfunden – eine Darstellung, die Google bestritt – und warnte, dass Modelle darauf trainiert werden können, in Benchmarks zu glänzen.

Vorerst ist Argon Googles stärkster Versuch, im Bereich hochrelevanter KI wieder Boden gutzumachen. Ob es sich tatsächlich um einen echten Sprung handelt, bleibt jedoch eine Frage für die Außenstehenden, denen die Nutzung noch nicht gestattet ist.