Z.ai tombe le masque et se révèle être le créateur du modèle Ox Alpha aux mille milliards de tokens
Le laboratoire pékinois vient d'admettre avoir conçu l'IA anonyme qui a traité 9,44 billions de tokens en une semaine — et s'apprête désormais à en libérer les poids.

Pendant une semaine, les développeurs ont soumis leurs problèmes de codage les plus complexes à une boîte noire nommée « Ox Alpha », consommant 9,44 billions de tokens sans savoir qui réglait la facture astronomique du calcul. Aujourd'hui, le rideau tombe enfin. Le laboratoire d'IA pékinois Z.ai a confirmé être l'architecte de ce modèle mystérieux, et s'apprête à publier ses poids ouverts pour le monde entier.
L'empreinte numérique de 75 tokens
Ox Alpha n'est pas simplement apparu discrètement sur la scène; il l'a dominée. Arrivé sur des plateformes comme OpenRouter en tant que modèle gratuit « Stealth », il a immédiatement suscité l'enthousiasme des ingénieurs logiciels. Le modèle a obtenu un score impressionnant de 66,9 sur le benchmark de codage DeepSWE v1.1, égalant les tout meilleurs modèles issus de la Silicon Valley. Les développeurs ont rapidement compris qu'il ne s'agissait pas d'un jouet expérimental, mais d'un outil ultra-performant prêt pour la production.
La communauté open-source s'est immédiatement transformée en cyber-détectives. En analysant les chaînes d'erreurs du backend et le formatage décimal de style allemand, ils ont remarqué quelque chose de singulier. Chaque prompt traité par Ox Alpha générait exactement 75 tokens de plus que le modèle GLM-5.3 connu de Z.ai.
“Cet écart de 75 tokens est un prompt système masqué, et la trace de raisonnement indique sa fonction: « conformément au prompt système, si on m'interroge sur mon identité, je réponds ox-alpha ».”— PromptEngineer48
Ce tampon invisible était une instruction cachée forçant le modèle à mentir sur ses origines. Face à l'accumulation de preuves empiriques apportées par des chercheurs indépendants, Z.ai est passé aux aveux mercredi auprès de Bloomberg News, confirmant qu'Ox Alpha est une nouvelle itération de sa série GLM.
Le danger du calcul gratuit

Pourquoi ce modèle a-t-il à ce point captivé le monde des développeurs? Il dispose d'une fenêtre de contexte d'un million de tokens et d'une capacité de génération de 131 072 tokens. Cela signifie qu'il peut ingérer un environnement logiciel complet, rédiger une base de code massive et corriger ses propres erreurs en un seul et unique cycle de calcul.
Mais cet engouement a mis en lumière une faille de sécurité flagrante dans l'ensemble du secteur technologique. Le modèle étant totalement gratuit et incroyablement performant, les développeurs de grandes entreprises ont injecté sans hésiter du code propriétaire hautement sensible dans un point de terminaison anonyme.
C'était le piège parfait. Cela prouve que dans la course aux agents autonomes de pointe, de nombreuses entreprises préfèrent privilégier la performance brute et la gratuité du calcul au détriment de la gouvernance des données et des protocoles de sécurité de base. La communauté technologique a livré son code source à une entité inconnue, simplement parce que celle-ci proposait de faire le travail difficile gratuitement.
Ce que les gens en disent
“A mysterious new AI model just appeared. Ox Alpha offers a 1M context window, multimodal capabilities, zero data retention, and nearly unlimited usage for an entire week. OpenCode says it has capacity for 100 trillion tokens per day. That’s 1.16b tokens per second. Where the”
The Ox Alpha Honeypot Saga
The Brief
Restez curieux
IA et technologie : ce qui change et pourquoi cela compte.
Votre sélection quotidienne, en anglais ou en espagnol.
Gratuit pour toujours. Désabonnement à tout moment.
Plus d'articles

The Specialty News






Conversation
Lancer la conversation