Histoire
août 28, 2026

La révélation d’Ox Alpha par Z.ai transforme une enquête sur l’IA en avertissement sur la Chine

Z.ai a confirmé que l’anonyme modèle Ox Alpha était son GLM-5.3-Flash, une version ouverte à faible coût qui a impressionné les développeurs avant que son créateur ne soit connu. Cette révélation a ravivé l’attention sur les concurrents chinois de l’IA, de plus en plus capables.

Pendant des jours, l’anonymat d’Ox Alpha a fait partie de son attrait : un puissant modèle gratuit est apparu, a impressionné les programmeurs et a déclenché un jeu mondial de devinettes. Son dévoilement a rendu plus difficile d’ignorer la question plus large : à quelle vitesse les laboratoires chinois d’IA peuvent transformer l’efficacité en influence.

La chronologie a commencé le 20 août, lorsqu’Ox Alpha est apparu anonymement sur OpenRouter, sans développeur nommé ni rapport technique. Les développeurs l’ont soumis à des tâches de programmation, de raisonnement et d’agents de longue durée, tandis que le fournisseur mettait gratuitement à disposition environ 100 000 milliards de tokens de capacité quotidienne. Z.ai a déclaré plus tard que l’exercice était un test en aveugle de GLM-5.3-Flash, conçu pour permettre aux utilisateurs d’évaluer le modèle avant d’en connaître le créateur.

Les spéculations ont suivi plusieurs pistes. Des similitudes techniques ont conduit certains observateurs vers la famille GLM de Z.ai, tandis que d’autres ont évoqué les modèles MAI de Microsoft ; des utilisateurs de Reddit ont souligné la disposition du modèle à aborder des sujets politiquement sensibles comme une raison de douter qu’il vienne de Chine. Puis la révélation est arrivée : « Ox Alpha est le GLM Flash de Zai », selon une publication partagée par le directeur général de Hugging Face, Clement Delangue.

Le récit de Z.ai sur le test ajoute une dimension géopolitique à ce qui aurait autrement pu être un lancement de produit. L’entreprise a indiqué que tout le trafic était traité par des clusters utilisant des puces d’IA fabriquées localement, malgré des contraintes de mémoire et de bande passante que les ingénieurs ont dû compenser grâce à des optimisations logicielles et des charges de travail. GLM-5.3-Flash est désormais disponible en poids ouverts sous licence MIT, positionnant sa conception de mélange d’experts à 320 milliards de paramètres comme un modèle que les développeurs peuvent exécuter et modifier plutôt que simplement louer.

En Chine, la révélation a été accueillie moins comme une surprise que comme un tour d’honneur. Des utilisateurs de Weibo ont célébré les performances et le prix du modèle, l’un d’eux le qualifiant de « ridiculement bon marché », tandis que d’autres ont vu dans le déploiement des puces la preuve que le matériel national peut prendre en charge l’IA à grande échelle.

Le cadrage concurrentiel s’élargit. L’équipe Qwen d’Alibaba a simultanément promu son propre aperçu open-weight et multimodal de Qwen3.8-Flash et promis des tarifs d’API bas. Pour les rivaux de Z.ai aux États-Unis, la leçon d’Ox Alpha est sans détour : la menace ne réside pas seulement dans un modèle mystérieux qui a dominé les conversations, mais dans un écosystème chinois en expansion, bâti autour de modèles performants à moindre coût.