Story
August 28, 2026

Die Enthüllung von Z.ais Ox Alpha macht aus einem KI-Krimi eine China-Warnung

Z.ai hat bestätigt, dass das anonyme Modell Ox Alpha sein GLM-5.3-Flash war, eine kostengünstige Veröffentlichung mit offenen Gewichten, die Entwickler beeindruckte, bevor ihr Hersteller bekannt war. Die Enthüllung hat die zunehmend leistungsfähigen KI-Herausforderer Chinas erneut in den Fokus gerückt.

Tagelang war die Anonymität von Ox Alpha Teil seines Reizes: Ein leistungsstarkes kostenloses Modell erschien, beeindruckte Programmierer und löste weltweit ein Ratespiel aus. Seine Enttarnung hat die größere Frage noch schwerer ignorierbar gemacht – wie schnell chinesische KI-Labore Effizienz in Einfluss verwandeln können.

Die Zeitleiste begann am 20. August, als Ox Alpha anonym auf OpenRouter erschien, ohne genannten Entwickler oder technischen Bericht. Entwickler testeten es mit Programmier-, Schlussfolgerungs- und lang laufenden Agentenaufgaben, während der Anbieter täglich rund 100 Billionen Token Kapazität kostenlos bereitstellte. Z.ai erklärte später, die Übung sei ein verblindeter Test von GLM-5.3-Flash gewesen, der darauf ausgelegt war, Nutzern die Bewertung des Modells zu ermöglichen, bevor sie seinen Hersteller kannten.

Die Spekulationen gingen in mehrere Richtungen. Technische Ähnlichkeiten führten einige Beobachter zur GLM-Familie von Z.ai, während andere Microsofts MAI-Modelle ins Spiel brachten; Reddit-Nutzer verwiesen auf die Bereitschaft des Modells, politisch sensible Themen zu diskutieren, als Grund zu bezweifeln, dass es aus China stamme. Dann kam die Enthüllung: „Ox Alpha ist Zais GLM Flash“, hieß es in einem Beitrag, den der Geschäftsführer von Hugging Face, Clement Delangue, teilte.

Der Bericht von Z.ai über den Test verleiht dem, was sonst eine Produkteinführung sein könnte, eine geopolitische Note. Das Unternehmen erklärte, der gesamte Datenverkehr sei über Cluster mit im Inland hergestellten KI-Chips abgewickelt worden – trotz Speicher- und Bandbreitenbeschränkungen, die Ingenieure durch Software- und Arbeitslastoptimierung ausgleichen mussten. GLM-5.3-Flash ist nun unter einer MIT-Lizenz mit offenen Gewichten verfügbar und positioniert sein Mixture-of-Experts-Design mit 320 Milliarden Parametern als Modell, das Entwickler ausführen und verändern können, statt es lediglich zu mieten.

In China wurde die Enthüllung weniger als Überraschung denn als Siegesrunde aufgenommen. Weibo-Nutzer feierten die Leistung und den Preis des Modells; einer nannte es „lächerlich billig“, während andere den Einsatz der Chips als Beleg dafür werteten, dass heimische Hardware KI im großen Maßstab unterstützen kann.

Die Wettbewerbsperspektive wird breiter. Alibabas Qwen-Team bewarb zeitgleich seine eigene Vorschau auf Qwen3.8-Flash mit offenen Gewichten und multimodalen Fähigkeiten und versprach niedrige API-Preise. Für die Rivalen von Z.ai in den USA ist die Lehre aus Ox Alpha eindeutig: Die Bedrohung ist nicht nur ein rätselhaftes Modell, das die Diskussion dominierte, sondern ein wachsendes chinesisches Feld, das auf leistungsfähigen Modellen zu niedrigeren Kosten aufgebaut ist.