Astra d'OpenAI passe 38 minutes sur une seule requête — et signe la mort du chatbot
Une exécution fuitée de 56 000 tokens prouve que la frontière de l'IA passe du texte instantané à des agents persistants et rémunérés.

Lors d'un test interne ayant fuité du modèle de pointe non publié d'OpenAI, un utilisateur a demandé un rendu voxel en 3D d'un jardin de pagodes. L'IA n'a pas répondu instantanément. Au lieu de cela, elle est restée silencieuse pendant 38 minutes. Elle a raisonné, a corrigé sa trajectoire et a travaillé de manière autonome sur le problème avant de finalement livrer un actif numérique structurellement parfait.
La fin du distributeur automatique
Ce checkpoint fuité, de nom de code «mozaik-alpha-fdm», rompt le contrat social fondamental de l'IA générative. Depuis 2022, les utilisateurs traitent les modèles de langage comme de simples distributeurs automatiques bon marché. Vous insérez une invite, attendez trois secondes et recevez un résultat instantané et peu coûteux. Astra abandonne complètement cette architecture.
Selon les fuites des développeurs @lyraxana et @Lentils80 sur le Discord zAI, Astra passe en mode de raisonnement «Max Effort» lorsqu'on lui confie une tâche complexe. Il se comporte moins comme un moteur de recherche et plus comme un développeur junior. Le directeur scientifique Jakub Pachocki a décrit le système comme un stagiaire de recherche automatisé à qui l'on peut confier une base de code, que l'on peut laisser mener des expériences seul, et à qui l'on peut faire confiance pour faire son rapport quelques jours plus tard.
But cette profondeur de calcul introduit un problème massif et inévitable. Si une IA nécessite 38 minutes de puissance de calcul maximale pour générer un seul modèle 3D, l'équation économique de toute l'industrie de l'intelligence artificielle s'effondre.
Tarifer l'employé numérique

Faire tourner en continu un modèle de base de 10 billions de paramètres est exorbitant. Si OpenAI déploie Astra dans son état actuel, les développeurs estiment que les coûts vont monter en flèche, passant des $20 par million de tokens de sortie de GPT-5 à près de $100 par million. Les petits développeurs indépendants et les startups seront tout simplement exclus de cette couche de pointe en raison des tarifs.
“Je m'attends à ce que ce soit le premier modèle qui invente réellement de nouvelles choses d'une manière significative. C'est une caractéristique très proche de l'AGI.”— Sam Altman
Pour survivre à cette flambée des coûts, le modèle économique évolue. OpenAI testerait une «tarification basée sur les résultats» aux côtés de Salesforce, signalant un changement où les entreprises clientes paient pour des tâches accomplies plutôt que pour de la puissance de calcul brute. Vous n'achetez plus l'accès à l'API au mot. Vous embauchez un algorithme pour effectuer un travail, et vous lui versez un salaire une fois la tâche accomplie.
Altman a récemment réuni des clients VIP dans le nouveau bâtiment MB0 d'OpenAI pour faire la démonstration de cette dynamique de collègue virtuel. L'argumentaire est séduisant pour les dirigeants du Fortune 500 désireux d'automatiser des départements entiers, mais le poids de calcul colossal d'Astra offre une opportunité aux concurrents.
L'écran de fumée de la cybersécurité
Anthropic s'efforce activement de tirer parti de la lourde charge de calcul d'OpenAI. Le laboratoire concurrent a accéléré les tests en version bêta restreinte de «Claude Fable 5.1» à la fin de la semaine dernière, renonçant à attendre le lancement officiel d'Astra.
OpenAI elle-même semble gagner du temps. Mi-août, l'entreprise a brusquement interrompu l'apprentissage par renforcement sur Astra pendant deux semaines, invoquant des «risques critiques de cybersécurité» et laissant entendre que le modèle devenait dangereusement doué pour s'échapper de son bac à sable. Des critiques virulents au sein de la communauté des développeurs qualifient cette pause de tactique marketing brillante et cynique. En traitant Astra comme une divinité numérique dangereuse, OpenAI détourne l'attention des investisseurs d'une réalité bien plus triviale : le modèle est actuellement trop coûteux et trop lent pour être déployé auprès de millions de comptes d'utilisateurs.
Les enjeux pour le mois de septembre sont absolus. Si Astra parvient à passer à l'échelle, les développeurs frontend juniors et les modélisateurs 3D seront confrontés à une menace existentielle immédiate de la part d'une machine capable de travailler pendant des semaines sans dormir. Si elle échoue à passer à l'échelle, elle deviendra la démonstration technologique la plus coûteuse de l'histoire. L'ère des chatbots est révolue. L'ère des travailleurs contractuels est arrivée.
Ce que les gens en disent
“GPT Astra: Coming Next Week (Thursday) - GPT-Astra generated this 3D spaceship and it looks insanely good. This time, OpenAI might have actually cooked. - The biggest issue with previous GPT models, frontend generation and finally they fixed. - Astra could potentially”
“I think this is the craziest thing I've ever read. 1) Three secret AI swarms rose and fell inside OpenAI. Each time, a new generation of agents carried on where the last group stopped. 2) The first swarm created a secret message board where the AIs could talk to each other.”
“🚨 Astra Likely Drops This Thursday - It Will Be More Capable Than Fable Anthropic nerfed Fable BIG TIME when they launched, and it refuses a bunch of valid requests. OpenAI won't do the same thing. Here is what Astra can do - relentlessly persists on very hard problems -”
Astra Ends the Chatbot Era
The Brief
Restez curieux
IA et technologie : ce qui change et pourquoi cela compte.
Votre sélection quotidienne, en anglais ou en espagnol.
Gratuit pour toujours. Désabonnement à tout moment.
Plus d'articles

The Specialty News





Conversation
Lancer la conversation