OpenAI présente Sora, son nouveau modèle de génération vidéo
OpenAI, l'une des entreprises pionnières dans le domaine de l'intelligence artificielle, a annoncé Sora, un nouveau modèle de génération vidéo capable de créer des scènes réalistes et imaginaires à partir d'instructions textuelles.
12punto
Le modèle texte-vidéo OpenAI Sora, capable de générer des vidéos d'une durée allant jusqu'à une minute avec un réalisme photographique basé sur les commandes saisies par les utilisateurs, allie technologie et créativité.
QUELLES SONT LES CARACTÉRISTIQUES DE SORA ?
Sora permet une large gamme de possibilités créatives, incluant des scènes complexes avec plusieurs personnages, des types de mouvements spécifiques, ainsi que des détails précis sur le sujet et l'arrière-plan. Selon le billet de blog de présentation d'OpenAI, le modèle est capable de comprendre comment les objets existent dans le monde physique, d'interpréter correctement les accessoires et de produire des personnages expressifs qui manifestent des émotions vives.
Parmi les démonstrations créées avec Sora, on trouve une vue aérienne de la Californie à l'époque de la ruée vers l'or, une vidéo semblant être filmée depuis un train traversant Tokyo, et bien d'autres. Cependant, OpenAI précise que le modèle peut rencontrer des difficultés à simuler correctement la physique d'une scène complexe.
Récemment, alors que des entreprises comme Runway et Pika attirent l'attention avec leurs propres modèles texte-vidéo, le modèle Lumiere de Google s'impose également comme l'un des principaux concurrents d'OpenAI dans ce domaine. Similairement à Sora, Lumiere propose aux utilisateurs des outils de création vidéo à partir de texte et offre également la possibilité de créer une vidéo à partir d'une image fixe.
Pour l'instant, OpenAI Sora est mis à la disposition des membres de l'équipe dite « red team », qui évalue les dommages et risques potentiels du modèle. Par ailleurs, OpenAI accorde également un accès à certains artistes visuels, designers et cinéastes afin de recueillir leurs retours. L'entreprise note que le modèle actuel pourrait ne pas être en mesure de reproduire fidèlement les lois physiques d'une scène complexe et pourrait mal interpréter certains exemples de cause à effet.
Comme pour ses autres produits d'IA, OpenAI devra faire face aux conséquences liées au fait que des vidéos générées par intelligence artificielle puissent être prises pour réelles. Dans ce contexte, l'entreprise a indiqué plus tôt ce mois-ci avoir ajouté des filigranes à son outil de génération d'images DALL-E 3, tout en précisant que ceux-ci pouvaient être « facilement supprimés ». Sora suscite d'importants débats, non seulement dans le monde de la technologie et de l'art, mais aussi sur les plans éthique et sociétal.