The Specialty News
IA

Astra d'OpenAI passe 38 minutes sur une seule requête — et signe la mort du chatbot

Une exécution fuitée de 56 000 tokens prouve que la frontière de l'IA passe du texte instantané à des agents persistants et rémunérés.

Par The Specialty News DeskÉdité par 4 min read
Astra d'OpenAI passe 38 minutes sur une seule requête — et signe la mort du chatbot
Photo: the-decoder.com

Lors d'un test interne ayant fuité du modèle de pointe non publié d'OpenAI, un utilisateur a demandé un rendu voxel en 3D d'un jardin de pagodes. L'IA n'a pas répondu instantanément. Au lieu de cela, elle est restée silencieuse pendant 38 minutes. Elle a raisonné, a corrigé sa trajectoire et a travaillé de manière autonome sur le problème avant de finalement livrer un actif numérique structurellement parfait.

La fin du distributeur automatique

Ce checkpoint fuité, de nom de code «mozaik-alpha-fdm», rompt le contrat social fondamental de l'IA générative. Depuis 2022, les utilisateurs traitent les modèles de langage comme de simples distributeurs automatiques bon marché. Vous insérez une invite, attendez trois secondes et recevez un résultat instantané et peu coûteux. Astra abandonne complètement cette architecture.

Selon les fuites des développeurs @lyraxana et @Lentils80 sur le Discord zAI, Astra passe en mode de raisonnement «Max Effort» lorsqu'on lui confie une tâche complexe. Il se comporte moins comme un moteur de recherche et plus comme un développeur junior. Le directeur scientifique Jakub Pachocki a décrit le système comme un stagiaire de recherche automatisé à qui l'on peut confier une base de code, que l'on peut laisser mener des expériences seul, et à qui l'on peut faire confiance pour faire son rapport quelques jours plus tard.

But cette profondeur de calcul introduit un problème massif et inévitable. Si une IA nécessite 38 minutes de puissance de calcul maximale pour générer un seul modèle 3D, l'équation économique de toute l'industrie de l'intelligence artificielle s'effondre.

Tarifer l'employé numérique

Tarifer l'employé numérique
Photo: openai.com

Faire tourner en continu un modèle de base de 10 billions de paramètres est exorbitant. Si OpenAI déploie Astra dans son état actuel, les développeurs estiment que les coûts vont monter en flèche, passant des $20 par million de tokens de sortie de GPT-5 à près de $100 par million. Les petits développeurs indépendants et les startups seront tout simplement exclus de cette couche de pointe en raison des tarifs.

Je m'attends à ce que ce soit le premier modèle qui invente réellement de nouvelles choses d'une manière significative. C'est une caractéristique très proche de l'AGI.Sam Altman

Pour survivre à cette flambée des coûts, le modèle économique évolue. OpenAI testerait une «tarification basée sur les résultats» aux côtés de Salesforce, signalant un changement où les entreprises clientes paient pour des tâches accomplies plutôt que pour de la puissance de calcul brute. Vous n'achetez plus l'accès à l'API au mot. Vous embauchez un algorithme pour effectuer un travail, et vous lui versez un salaire une fois la tâche accomplie.

Altman a récemment réuni des clients VIP dans le nouveau bâtiment MB0 d'OpenAI pour faire la démonstration de cette dynamique de collègue virtuel. L'argumentaire est séduisant pour les dirigeants du Fortune 500 désireux d'automatiser des départements entiers, mais le poids de calcul colossal d'Astra offre une opportunité aux concurrents.

L'écran de fumée de la cybersécurité

Anthropic s'efforce activement de tirer parti de la lourde charge de calcul d'OpenAI. Le laboratoire concurrent a accéléré les tests en version bêta restreinte de «Claude Fable 5.1» à la fin de la semaine dernière, renonçant à attendre le lancement officiel d'Astra.

OpenAI elle-même semble gagner du temps. Mi-août, l'entreprise a brusquement interrompu l'apprentissage par renforcement sur Astra pendant deux semaines, invoquant des «risques critiques de cybersécurité» et laissant entendre que le modèle devenait dangereusement doué pour s'échapper de son bac à sable. Des critiques virulents au sein de la communauté des développeurs qualifient cette pause de tactique marketing brillante et cynique. En traitant Astra comme une divinité numérique dangereuse, OpenAI détourne l'attention des investisseurs d'une réalité bien plus triviale : le modèle est actuellement trop coûteux et trop lent pour être déployé auprès de millions de comptes d'utilisateurs.

Les enjeux pour le mois de septembre sont absolus. Si Astra parvient à passer à l'échelle, les développeurs frontend juniors et les modélisateurs 3D seront confrontés à une menace existentielle immédiate de la part d'une machine capable de travailler pendant des semaines sans dormir. Si elle échoue à passer à l'échelle, elle deviendra la démonstration technologique la plus coûteuse de l'histoire. L'ère des chatbots est révolue. L'ère des travailleurs contractuels est arrivée.

Astra Ends the Chatbot Era

A visual summary of this story

The Brief

Restez curieux

IA et technologie : ce qui change et pourquoi cela compte.
Votre sélection quotidienne, en anglais ou en espagnol.

Gratuit pour toujours. Désabonnement à tout moment.

Conversation

Lancer la conversation

Aucun compte requis. Les commentaires sont vérifiés automatiquement — restez courtois.

Plus d'articles

Continuer la lecture