The Specialty News
IA

Runway et NVIDIA écrasent la latence avec la génération vidéo par IA en temps réel

Le nouveau modèle livre des images en haute définition en moins de 100 millisecondes, plus vite qu'un clignement d'œil humain.

Par The Specialty News DeskÉdité par 5 min read
Runway et NVIDIA écrasent la latence avec la génération vidéo par IA en temps réel
Photo: imgix / Unsplash

L'attente interminable pour qu'une vidéo générée par IA se rende est officiellement en train de devenir un vestige du passé. Lors de la conférence GTC de NVIDIA cette semaine, Runway a dévoilé un nouveau modèle génératif capable de produire une vidéo en haute définition avec un délai avant la première image inférieur à 100 millisecondes. Pour donner une idée, c'est plus rapide qu'un clignement d'œil humain moyen, qui dure généralement entre 100 et 400 millisecondes. Il s'agit d'un bond de performance stupéfiant qui fait passer l'IA du statut d'outil de rendu en arrière-plan à celui d'instrument créatif interactif et en direct.

La technologie derrière l'instantané

Ce bond de vitesse n'est pas une simple optimisation logicielle ; c'est une prouesse d'ingénierie qui touche toute la chaîne technique. La démonstration s'appuie sur la nouvelle plateforme Vera Rubin de NVIDIA, une véritable bête de course dotée de l'architecture GPU Rubin, des nouveaux processeurs Vera et d'une mémoire HBM4 à large bande passante. En co-concevant le GWM-1 (General World Model) spécifiquement pour cette architecture matérielle, Runway a réussi à contourner les goulots d'étranglement de calcul qui plombaient jusqu'ici la vidéo générative. Les modèles de générations précédentes fonctionnaient selon un flux de travail « traiter et attendre », nécessitant souvent plusieurs minutes pour produire ne serait-ce que de courts clips saccadés. En réduisant la latence sous le seuil des 100 ms, Runway ouvre un espace de conception fondamentalement différent. Il est désormais possible d'ajuster les instructions ou de changer d'angle de caméra en temps réel, en regardant l'IA répondre à votre intention créative comme si vous dirigiez un plateau de tournage numérique à la volée.

De clips figés à des mondes vivants

De clips figés à des mondes vivants
Photo: Michael Dziedzic / Unsplash

La véritable portée de cette avancée tient à son rôle de brique fondatrice pour ce que les chercheurs appellent les « World Models », ou modèles du monde. Ce sont des systèmes conçus non seulement pour imiter le visuel, mais pour comprendre la physique, l'espace et la causalité. Lorsque ces simulations peuvent être rendues en temps réel, la technologie passe du statut de tour de passe-passe à celui de simulateur applicable à tout, de la robotique autonome aux environnements de jeu immersifs et sensibles à la physique. Des défis subsistent, bien sûr. Faire passer cette performance d'un rack de supercalcul à plusieurs millions de dollars aux appareils grand public que nous avons dans nos poches sera le prochain grand obstacle. De plus, maintenir une cohérence physique durable pendant la diffusion reste un domaine de recherche actif. Mais la trajectoire est indéniable : il y a à peine cinq ans, les modèles mettaient 15 minutes à produire une seule scène floue. Aujourd'hui, nous assistons pratiquement à la naissance d'un « Holodeck » en temps réel capable de synthétiser la réalité à la demande.

nous assistons pratiquement à la naissance d'un « Holodeck » en temps réel capable de synthétiser la réalité à la demande.

Video at the Speed of Sight

A visual summary of this story

The Brief

Restez curieux

IA et technologie : ce qui change et pourquoi cela compte.
Votre sélection quotidienne, en anglais ou en espagnol.

Gratuit pour toujours. Désabonnement à tout moment.

Conversation

Lancer la conversation

Aucun compte requis. Les commentaires sont vérifiés automatiquement — restez courtois.

Plus d'articles

Continuer la lecture