Storia
agosto 28, 2026
La rivelazione di Ox Alpha di Z.ai trasforma un giallo sull’IA in un monito sulla Cina
Z.ai ha confermato che l’anonimo modello Ox Alpha era il suo GLM-5.3-Flash, un rilascio open-weight a basso costo che ha impressionato gli sviluppatori prima che se ne conoscesse il creatore. La rivelazione ha riportato l’attenzione sui concorrenti cinesi dell’IA, sempre più capaci.
Per giorni, l’anonimato di Ox Alpha è stato parte del suo fascino: è apparso un potente modello gratuito, ha impressionato i programmatori e acceso un gioco globale di ipotesi. Il suo smascheramento ha reso più difficile ignorare la domanda più importante: quanto rapidamente i laboratori cinesi di IA possano trasformare l’efficienza in influenza.
La cronologia è iniziata il 20 agosto, quando Ox Alpha è apparso anonimamente su OpenRouter, senza uno sviluppatore indicato né un rapporto tecnico. Gli sviluppatori lo hanno messo alla prova con attività di programmazione, ragionamento e agenti a lunga esecuzione, mentre il fornitore ha reso disponibile gratuitamente una capacità giornaliera di circa 100 trilioni di token. Z.ai ha poi affermato che l’esercizio era un test in cieco di GLM-5.3-Flash, concepito per consentire agli utenti di valutare il modello prima di conoscerne il creatore.1
Le speculazioni si sono mosse in varie direzioni. Le somiglianze tecniche hanno portato alcuni osservatori verso la famiglia GLM di Z.ai, mentre altri hanno ipotizzato i modelli MAI di Microsoft; gli utenti di Reddit hanno indicato la disponibilità del modello a discutere argomenti politicamente sensibili come ragione per dubitare che provenisse dalla Cina.2 Poi è arrivata la rivelazione: «Ox Alpha è il GLM Flash di Zai», secondo un post condiviso dall’amministratore delegato di Hugging Face, Clement Delangue.
3
Il resoconto di Z.ai sul test aggiunge una dimensione geopolitica a quella che altrimenti potrebbe essere una presentazione di prodotto. L’azienda ha affermato che tutto il traffico era gestito da cluster che utilizzavano chip per IA prodotti internamente, nonostante vincoli di memoria e larghezza di banda che gli ingegneri hanno dovuto compensare attraverso l’ottimizzazione del software e dei carichi di lavoro.4 GLM-5.3-Flash è ora open-weight con licenza MIT, posizionando il suo design mixture-of-experts da 320 miliardi di parametri come un modello che gli sviluppatori possono eseguire e modificare anziché semplicemente noleggiare.
In Cina, la rivelazione è stata accolta meno come una sorpresa che come un giro d’onore. Gli utenti di Weibo hanno celebrato le prestazioni e il prezzo del modello, con uno che lo ha definito «ridicolmente economico», mentre altri hanno considerato l’impiego dei chip una prova che l’hardware nazionale può supportare l’IA su larga scala.5
L’inquadramento competitivo si sta ampliando. Il team Qwen di Alibaba ha contemporaneamente promosso l’anteprima del proprio Qwen3.8-Flash multimodale e open-weight, promettendo prezzi API bassi.
6 Per i rivali statunitensi di Z.ai, la lezione di Ox Alpha è netta: la minaccia non è solo un modello misterioso che ha dominato la conversazione, ma un crescente panorama cinese costruito attorno a modelli capaci a costi inferiori.7