The Specialty News
IA

Z.ai tombe le masque et se révèle être le créateur du modèle Ox Alpha aux mille milliards de tokens

Le laboratoire pékinois vient d'admettre avoir conçu l'IA anonyme qui a traité 9,44 billions de tokens en une semaine — et s'apprête désormais à en libérer les poids.

Par The Specialty News DeskÉdité par 4 min read
Z.ai tombe le masque et se révèle être le créateur du modèle Ox Alpha aux mille milliards de tokens
Photo: techcrunch.com

Pendant une semaine, les développeurs ont soumis leurs problèmes de codage les plus complexes à une boîte noire nommée « Ox Alpha », consommant 9,44 billions de tokens sans savoir qui réglait la facture astronomique du calcul. Aujourd'hui, le rideau tombe enfin. Le laboratoire d'IA pékinois Z.ai a confirmé être l'architecte de ce modèle mystérieux, et s'apprête à publier ses poids ouverts pour le monde entier.

L'empreinte numérique de 75 tokens

Ox Alpha n'est pas simplement apparu discrètement sur la scène; il l'a dominée. Arrivé sur des plateformes comme OpenRouter en tant que modèle gratuit « Stealth », il a immédiatement suscité l'enthousiasme des ingénieurs logiciels. Le modèle a obtenu un score impressionnant de 66,9 sur le benchmark de codage DeepSWE v1.1, égalant les tout meilleurs modèles issus de la Silicon Valley. Les développeurs ont rapidement compris qu'il ne s'agissait pas d'un jouet expérimental, mais d'un outil ultra-performant prêt pour la production.

La communauté open-source s'est immédiatement transformée en cyber-détectives. En analysant les chaînes d'erreurs du backend et le formatage décimal de style allemand, ils ont remarqué quelque chose de singulier. Chaque prompt traité par Ox Alpha générait exactement 75 tokens de plus que le modèle GLM-5.3 connu de Z.ai.

Cet écart de 75 tokens est un prompt système masqué, et la trace de raisonnement indique sa fonction: « conformément au prompt système, si on m'interroge sur mon identité, je réponds ox-alpha ».PromptEngineer48

Ce tampon invisible était une instruction cachée forçant le modèle à mentir sur ses origines. Face à l'accumulation de preuves empiriques apportées par des chercheurs indépendants, Z.ai est passé aux aveux mercredi auprès de Bloomberg News, confirmant qu'Ox Alpha est une nouvelle itération de sa série GLM.

Le danger du calcul gratuit

Le danger du calcul gratuit
Photo: openrouter.ai

Pourquoi ce modèle a-t-il à ce point captivé le monde des développeurs? Il dispose d'une fenêtre de contexte d'un million de tokens et d'une capacité de génération de 131 072 tokens. Cela signifie qu'il peut ingérer un environnement logiciel complet, rédiger une base de code massive et corriger ses propres erreurs en un seul et unique cycle de calcul.

Mais cet engouement a mis en lumière une faille de sécurité flagrante dans l'ensemble du secteur technologique. Le modèle étant totalement gratuit et incroyablement performant, les développeurs de grandes entreprises ont injecté sans hésiter du code propriétaire hautement sensible dans un point de terminaison anonyme.

C'était le piège parfait. Cela prouve que dans la course aux agents autonomes de pointe, de nombreuses entreprises préfèrent privilégier la performance brute et la gratuité du calcul au détriment de la gouvernance des données et des protocoles de sécurité de base. La communauté technologique a livré son code source à une entité inconnue, simplement parce que celle-ci proposait de faire le travail difficile gratuitement.

The Ox Alpha Honeypot Saga

A visual summary of this story

The Brief

Restez curieux

IA et technologie : ce qui change et pourquoi cela compte.
Votre sélection quotidienne, en anglais ou en espagnol.

Gratuit pour toujours. Désabonnement à tout moment.

Conversation

Lancer la conversation

Aucun compte requis. Les commentaires sont vérifiés automatiquement — restez courtois.

Plus d'articles

Continuer la lecture