OpenAI dévoile GPT-5.4 mini et nano pour des flux de travail agentiques ultra-rapides
Avec une vitesse doublée et un bond spectaculaire dans les benchmarks d'utilisation d'ordinateur, OpenAI opère un virage vers une architecture d'IA « manager-exécutant ».

L'intelligence artificielle vient de bénéficier d'une nette amélioration de ses réflexes. OpenAI a officiellement présenté GPT-5.4 mini et nano, deux modèles légers et performants conçus pour abattre le gros du travail du monde numérique. En échangeant une partie de la surcharge de raisonnement brut contre une vitesse fulgurante et un excellent rapport coût-efficacité, ces modèles s'apprêtent à devenir la salle des machines d'une nouvelle génération d'agents autonomes.
Le basculement vers l'agentivité en temps réel
Le chiffre phare ici est le bond de performance : GPT-5.4 mini est deux fois plus rapide que son prédécesseur, GPT-5 mini. Mais pour ceux qui développent des logiciels, la vraie histoire se trouve dans les benchmarks. Le nouveau modèle atteint un score de 72,1 % sur les tests OSWorld-Verified — contre 42,0 % auparavant — signe d'une amélioration majeure de la capacité de l'IA à « voir » et interagir avec les interfaces informatiques. Il repousse aussi les limites en programmation, en enregistrant un taux de réussite de 54,4 % sur SWE-Bench Pro, ce qui en fait un outil redoutable pour les développeurs qui ont besoin d'un retour en temps réel et réactif pendant les sessions de « vibe coding ».
Il ne s'agit pas seulement de réduire la taille des modèles ; il s'agit de les rendre plus intelligents sur des tâches spécifiques et à haute fréquence. En obtenant un score de 88,0 % sur le redoutable benchmark de raisonnement GPQA Diamond, OpenAI s'est assuré que ces modèles plus « petits » ne sont pas de simples gadgets : ils sont assez capables pour gérer des sous-tâches complexes qui auraient auparavant nécessité un modèle phare coûteux et lent. Cela ouvre un nouveau palier d'efficacité pour des entreprises comme Notion, GitHub et Whoop, qui ont besoin d'une IA qui répond en millisecondes, pas en secondes.
Construire l'avenir de l'IA modulaire

L'introduction des variantes mini et nano met en lumière un virage structurel de l'industrie : le passage à une architecture « manager-exécutant ». Dans cette conception, un modèle massif et « pensant » agit comme chef de projet, définissant les stratégies complexes et les décisions de haut niveau. Il délègue ensuite l'exécution — écrire des bouts de code, analyser des documents ou effectuer des actions dans l'interface — à ces exécutants mini et nano ultra-rapides.
“Le gagnant de la prochaine phase de l'IA ne sera pas seulement le modèle le plus intelligent ; ce sera le plus réactif.”
Cette approche modulaire est la façon dont l'IA finira par s'intégrer dans nos flux de travail professionnels quotidiens. À mesure que l'on s'éloigne des chatbots statiques pour aller vers des agents actifs capables de vraiment « faire » les choses, le goulot d'étranglement sera la latence. En proposant ces exécutants hautement optimisés et à faible latence, OpenAI pose les fondations d'un écosystème d'agents qui ne se contentent pas de discuter, mais qui exécutent des tâches de façon autonome. Le gagnant de la prochaine phase de l'IA ne sera pas seulement le modèle le plus intelligent ; ce sera le plus réactif.
Manager-Worker AI
The Brief
Restez curieux
IA et technologie : ce qui change et pourquoi cela compte.
Votre sélection quotidienne, en anglais ou en espagnol.
Gratuit pour toujours. Désabonnement à tout moment.
Plus d'articles

The Specialty News





Conversation
Lancer la conversation