Le modèle fuité Luna-Lisa d'OpenAI résout le problème de cohérence des personnages de l'IA
Un checkpoint anonyme sur LMArena laisse présager la sortie imminente de GPT Image 3, qui pourrait définitivement éliminer l'étape de retouche sur Photoshop

Au cours de la semaine dernière, un modèle text-to-image anonyme est apparu discrètement sur la plateforme de tests à l'aveugle LMArena. Baptisé « luna-lisa-alpha », ce checkpoint anonyme est largement considéré comme un premier aperçu du générateur d'images de nouvelle génération d'OpenAI. Si les testeurs de prompts qui inondent la plateforme ont raison, l'ère des visages déformés et des panneaux de signalisation incompréhensibles est officiellement révolue.
Le test Charlie Kirk
La communauté de l'IA n'a pas seulement testé ce nouveau modèle pour générer de jolies images ; elle l'a mis à l'épreuve sur ses connaissances du monde réel. L'une des plus grandes limites du précédent checkpoint « mona-lisa-1 », apparu début août, était sa base de connaissances obsolète s'arrêtant à mai 2025. Pour voir si la version « luna-lisa-alpha » était plus intelligente, le testeur @chetaslua a déployé ce qu'il a appelé le « test Charlie Kirk ».
En soumettant au modèle un prompt évoquant la fusillade tragique et très médiatisée de l'activiste conservateur en septembre 2025, le testeur a vérifié que la nouvelle IA comprend les événements culturels récents. Le modèle ne se contente pas de dessiner ; il dessine avec une compréhension du monde postérieure à septembre 2025. Pour les utilisateurs, cela signifie que le système peut représenter fidèlement les derniers équipements technologiques, des personnalités contemporaines et des contextes culturels modernes.
“De Mona Lisa à Luna Lisa - une véritable étape vers GPT Image 2.5, ou juste un autre checkpoint qui suit son cours ? ... l'information principale n'est pas le réalisme... L'information principale, c'est la date limite des connaissances.”— Tosea.ai
Au-delà de son intelligence, le rendu du modèle a fondamentalement changé. Les testeurs rapportent que l'aspect artificiel brillant de l'IA — cette texture légèrement plastique et trop lisse qui trahit les médias synthétiques — a été entièrement éliminé. À la place, on trouve un éclairage naturel, un photoréalisme cinématographique et une absence du bruit visuel qui parasitait les versions précédentes.
La fin de la logique du rêve

Pendant des années, les générateurs d'images par IA ont fonctionné selon ce que l'on ne peut décrire que comme une logique de rêve. Des mains se retrouvaient avec sept doigts, le texte se transformait en runes extraterrestres et le visage d'un personnage changeait radicalement d'un prompt à l'autre. Le checkpoint « luna-lisa-alpha » montre que nous avons enfin résolu la physique fondamentale de la génération d'images par IA.
Le modèle fait preuve d'une capacité révolutionnaire à conserver l'apparence exacte, les vêtements et le style d'un personnage à travers plusieurs générations et sous différents angles de caméra. Il produit également un texte très précis et lisible. Les testeurs l'utilisent déjà pour générer des maquettes d'interface utilisateur impeccables pour des applications mobiles, transformant ainsi un simple prompt textuel en un document de conception au pixel près.
Si l'on se fie à l'histoire, cette phase de test public suggère qu'une sortie est imminente. Les observateurs de l'IA notent qu'OpenAI effectue généralement ces tests à l'aveugle environ deux semaines avant un lancement majeur. Ce calendrier pointe directement vers une sortie fin août ou en septembre, préparant potentiellement le terrain pour une annonce majeure lors du DevDay d'OpenAI le 29 septembre.
Les obstacles de sécurité et d'entreprise
La rapidité de ce développement est dictée par une course aux armements multimodale féroce. OpenAI se bat pour maintenir sa domination sur le marché des entreprises face à Midjourney, Nano Banana Pro de Google et Grok Imagine de xAI. En effectuant des tests A/B à l'aveugle sur LMArena, OpenAI extrait des données brutes sur les préférences humaines, ce qui lui permet d'ajuster le modèle précisément à ce que le marché juge esthétique.
Cependant, une base de connaissances actualisée comporte de graves risques de sécurité. La capacité de générer des images photoréalistes de tragédies récentes du monde réel — précisément ce que le test Charlie Kirk a prouvé possible — signifie qu'OpenAI devra mettre en place des garde-fous stricts avant une sortie publique. La menace de deepfakes liés à l'actualité est plus élevée que jamais lorsque le rendu de l'IA est aussi parfait.
De plus, les entreprises ne vont pas concevoir leurs flux de production créative autour d'un checkpoint anonyme de LMArena. Tant qu'OpenAI n'aura pas officiellement standardisé l'API de ce modèle et garanti sa stabilité, l'adoption à l'échelle de l'entreprise restera en pause. La technologie est prête, mais l'infrastructure est à la traîne.
De la curiosité au moteur de production
Nous franchissons le seuil qui sépare l'IA perçue comme une curiosité originale de l'IA comme moteur de production fiable. La capacité de restituer du texte de manière fiable et de garantir la cohérence des personnages ouvre la voie aux développeurs de jeux indépendants, aux créateurs de bandes dessinées et aux agences numériques pour finaliser leurs créations sans passer des heures à faire des retouches sur Photoshop.
Le changement le plus profond ne se fera toutefois pas dans le domaine artistique, mais dans celui du développement logiciel. Si un modèle d'image peut imaginer avec précision une interface de smartphone complexe, des agents de codage basés sur la vision peuvent immédiatement traduire cette maquette en code fonctionnel. Nous nous dirigeons vers un flux de travail où la conception d'une application et son codage sont en fait une seule et même étape.
Nous n'apprenons plus à l'IA à dessiner. Nous lui demandons simplement quoi construire, en lui faisant confiance pour livrer un produit fini. L'écart entre une idée créative et un actif déployable n'a jamais été aussi réduit.
Ce que les gens en disent
“GPT-Image 2.5 Leaks: "Luna-Lisa-Alpha" - A new GPT-Image checkpoint "luna-lisa-alpha" is now being tested in Arena. The previous checkpoint was mona-lisa. - It looks better than mona-lisa, especially in realism and overall image quality. - The noise/grain seen in mona-lisa gone”

“Example from the new @OpenAI image model that we might get today. Codename "luna-lisa-alpha". The prefix "luna" could indicate it's a smaller version based on GPT Luna. Don't underestimate the significance of image models! They can generate the design for an entire website,”

The Luna-Lisa Image Breakthrough
The Brief
Restez curieux
IA et technologie : ce qui change et pourquoi cela compte.
Votre sélection quotidienne, en anglais ou en espagnol.
Gratuit pour toujours. Désabonnement à tout moment.
Plus d'articles

The Specialty News






Conversation
Lancer la conversation