Sora (IA)
| Créateur | OpenAI |
|---|---|
| Développé par | OpenAI |
| Fichier exécutable | images vidéo de résolution allant jusqu'à 1920 x 1080 et jusqu'à 1080 x 1920, générées à partir de commandes naturelles |
| Première version | 15 février 2024 (pour les beta-testeurs uniquement) |
| Dernière version | 9 décembre 2024 (pour tous les utilisateurs souscrits à ChatGPT Plus et Pro) |
| Supporte les langages | Langage naturel |
| Type | Intelligence artificielle générative |
| Site web | sora.com |
Chronologie des versions
Sora est un modèle texte-vidéo développé par OpenAI, lancé en 2024 et arrêté deux ans plus tard. Cette intelligence artificielle peut générer des vidéos de haute qualité, fluides, cohérentes, réalistes et immersives à partir de courtes invites descriptives[1], ainsi que prolonger les vidéos existantes vers l'avant ou vers l'arrière dans le temps[2].
Comme Dall-E, Sora s'appuie sur des modèles qui lui permettant d'analyser et de comprendre les nuances du langage humain dans les descriptions textuelles.
Cette IA, comme toutes les IA générative perfectionnées et par sa capacité à transformer des phrases simples en vidéos, peut aider à la création en communication, pédagogie, divertissement et d'autres domaines. Elle suscite parallèlement des questions éthiques, juridiques, morales, économiques et des inquiétudes concernant le respect des droits d'auteur et des utilisations malveillantes.
Dénomination
L'équipe qui développe Sora lui donne le nom du mot japonais signifiant « ciel » pour signifier « son potentiel créatif illimité ». La technologie derrière Sora est une adaptation de la technologie derrière le modèle texte-image DALL-E 3[3].
Histoire
Sora
OpenAI présente au grand public quelques vidéos haute définition créées par Sora le [4], déclarant que la technologie est capable de générer des vidéos d'une durée allant jusqu'à une minute[5].
Les vidéos générées par Sora sont cryptographiquement signées, étiquetées avec des métadonnées incluant un digimarc de type C2PA (Coalition for Content Provenance and Authenticity)[6] pour indiquer qu'elles sont générées par l'IA. Ils partagent également Sora avec un petit groupe de professionnels de la création, notamment des vidéastes et des artistes, pour obtenir des commentaires sur son utilité[7].
L'entreprise ne partage pas de rapport technique ni ne démontre comment les vidéos sont générées par le modèle. Elle reconnait certaines lacunes du système, notamment des difficultés à simuler une physique complexe[8]. Will Douglas Heaven de la MIT Technology Review qualifie les vidéos de démonstration d'« impressionnantes », mais note qu'elles doivent avoir été sélectionnées avec soin et qu'elles peuvent ne pas être représentatives de la production typique de Sora[9].
Sora a été lancée au grand public parmi les utilisateurs payants de ChatGPT Plus et de ChatGPT Pro le [10].
À partir du , l'application devient capable de créer des images en utilisant le nouveau modèle ChatGPT-4o Images[11] et de générer des vidéos directement à partir de ces images[12].
De nombreux commentateurs, tel l'universitaire américain Oren Etzioni (en) s'inquiètent des détournement possibles de cette technologie à des fins d'influence et de désinformation en ligne, en particulier pour les campagnes politiques[13]. La vidéo créée par IA a en effet le potentiel de renforcer la crédibilité et la propagation de deepfakes de plus en plus sophistiqués, et plus généralement de fausses informations, ou encore des contenus dits « inappropriés » ou offensants (ce pourquoi ces vidéos seront taguées au moyen d'un filigrane numérique et de métadonnées pour faciliter la détection de mésusages et d'éventuelles poursuites contre leurs auteurs, bien que des contournements existent à propos du filigrane[14]).
Sora 2
Sora 2 est annoncé par OpenAI le et son lancement est accompagné d'une application mobile. Ce lancement est un succès, l'application se classe rapidement en première place de l'App Store américain d'Apple[15]. Sora 2 a pour ambition d'être un réseau social sur le modèle de TikTok (fil et créations de vidéos) dont le contenu est entièrement généré par intelligence artificielle[16]. Elle n'est pas encore disponible en Europe, sans date de sortie officielle[17].
Droits d'auteurs
OpenAI entraîne son modèle à l'aide de vidéos accessibles au public ainsi, peut-être, que de vidéos protégées par le droit d'auteur (sous licence à cet effet), mais ne révèle pas le nombre ni la source exacte des vidéos[18].
À son lancement, des vidéos de personnages de séries ou de jeux vidéos comme Super Mario, Sonic ou Pikachu sont générées via l'application et partagées sur internet. Cela entraîne des protestations et des critiques de la part d'entreprises détentrices de droits d'auteur à l'instar de studios de jeux vidéos ou d'animation[19],[20],[21], d'agences d'artistes et de studios américains[22], mais aussi du monde politique comme au Japon[23]. Dans la foulée OpenAI, par la voix de son PDG Sam Altman, indique prendre des mesures pour renforcer sa politique sur les droits d'auteur mais dans le même temps précise attendre des détenteurs de droits qu'ils signalent explicitement à l'entreprise refuser l'utilisation de leurs oeuvres par l'intelligence artificielle Sora 2[24].
Le , Disney et OpenAI signent un accord de licence d'une durée de trois ans. Il est ainsi prévu que l'entreprise de divertissement américaine mette à disposition environ 200 personnages de son catalogue pour permettre aux utilisateurs et utilisatrices de Sora de générer de courtes vidéos les mettant en scène via l'intelligence artificielle. Les deux entreprises y verraient également la démonstration « d'un usage responsable et encadré de l'IA »[25].
Vidéos de personnalités décédées
Au lancement de Sora 2 des vidéos virales de célébrités décédées sont générées et diffusées largement. On peut y voir Michael Jackson volant des nuggets, Stephen Hawking dans un ring de boxe ou encore Charles de Gaulle promouvant un produit de jardin fictif. Elles suscitent des réactions négatives et de la colère, notamment de la part de certains membres de la famille de ces vedettes, se plaignant de leur non consentement à ces utilisations. En réaction OpenAI annonce empêcher l'emploi vidéo de personnalités décédées récemment par les utilisateurs si leurs proches réclament leur interdiction[26],[27]. L'encadrement de ces pratiques reste flou aux États-Unis, tout comme la notion de « personnalités décédées récemment »[28].
Contenu violent et diffusion de vidéos racistes
Avec Sora 2, OpenAI rend disponible une nouvelle option : « cameo », qui permet à ses utilisateurs de partager leur image pour que d'autres utilisateurs créent des vidéos à partir de celle-ci[29],[30].
Le , de nombreuses vidéos générées à partir de Sora 2 sont publiées et diffusées sur différents réseaux sociaux. Elles surfent sur une tendance francophone qui consiste à mettre en scène de fausses capsules du youtubeur Tibo InShape[31], ce dernier ayant accepté de rendre disponible son image à travers la fonction « cameo ». Parfois absurdes et humoristiques, une grand partie de ces vidéos présentent néanmoins des actions et propos discriminants ou racistes[32]. On y retrouve par exemple le vidéaste cadenassant son vélo à l'aide de tranches de jambon (la viande de porc étant interdite à la consommation dans la religion musulmane) ou refusant de donner de la nourriture à une femme voilée. Ainsi, selon le journal Le Monde, il est facile de contourner les règles de censure de l'application concernant ici l'insulte raciste « bougnoule », répétée par l'alias artificiel de Tibo InShape et nourrissant une partie de la tendance[33].
Enfin, selon une enquête du journal indépendant 404 Media des comptes utilisateurs des réseaux sociaux X et TikTok seraient dédiés à la publication de vidéos violentes de femmes se faisant étrangler et générées grâce à Sora 2[34].
Fermeture de Sora 2
Le , OpenAI décide de mettre fin à l'application Sora 2, dans un contexte de recentrage au vu des faibles bénéfices engendrés par la société en comparaison au coût grandissant de leur activité, l'application disparaît dès le et l'API abandonne dès le prochain[35].
Technologie
Le « rapport technique » ne contient essentiellement aucune information technique selon laquelle il s'agit d'une diffusion débruitante dans l'espace latent avec (au moins) un transformeur comme débruiteur. Cette conception est standard pour les générateurs d'images de diffusion comme Stable Diffusion (sauf que Stable Diffusion utilise un U-Net au lieu d'un transformeur). Une vidéo est générée dans l'espace latent par débruitage de « patchs » 3D (2D d'espace et 1D de temps), puis transformée en espace standard par un décompresseur vidéo. Le re-sous-titrage est utilisé pendant la formation pour créer de bons sous-titres sur des vidéos qui n'en ont pas.
Dans la fiction/culture
L'épisode 3 de la saison 28 de la série américaine South Park (en anglais « Sora Not Sorry » et en français « Sora saura pas ») montre de manière satirique les dérives possibles de Sora. Dans l'épisode, les enfants de l'école de South Park s'attaquent les uns les autres par vidéos interposées mimant des actes sexuels entre eux et des personnages de dessin-animé. Très vite, les choses prennent une dimension incontrôlable à mesure que les vidéos se multiplient. Bien que parodique, cet épisode témoigne des préoccupations grandissantes des mésusages de ces vidéos générées par IA dans la société, notamment auprès des publics jeunes plus vulnérables.
Notes et références
- (en) Cet article est partiellement ou en totalité issu de l’article de Wikipédia en anglais intitulé « Sora (text-to-video model) » (voir la liste des auteurs).
- ↑ (en) « OpenAI Unveils A.I. That Instantly Generates Eye-Popping Videos », sur The New York Times, .
- ↑ (en) « Video generation models as world simulators », sur openai.com, .
- ↑ (en) « OpenAI teases an amazing new generative video model called Sora », sur MIT Technology Review, .
- ↑ « OpenAI dévoile Sora, sa nouvelle intelligence artificielle qui transforme les textes en vidéos », Libération, (lire en ligne
). - ↑ « OpenAI dévoile Sora, un générateur de vidéos "révolutionnaire" », RTBF, (lire en ligne
). - ↑ Dominique Filippone, « OpenAI lance son générateur de vidéo Sora sauf en Europe », Le Monde informatique, (lire en ligne
). - ↑ (en) Dara Kerr, « OpenAI makes AI video generator Sora publicly available in US », The Guardian, (lire en ligne
). - ↑ (en) « OpenAI Reveals ‘Sora’: AI Video Model Capable Of Realistic Text-To-Video Prompts », sur Forbes, .
- ↑ (en) Will Douglas Heaven, « OpenAI teases an amazing new generative video model called Sora », MIT Technology Review, (lire en ligne
). - ↑ (en-US) « Sora is here », sur openai.com (consulté le ).
- ↑ (en-US) « Introducing 4o Image Generation », sur openai.com (consulté le ).
- ↑ (en) « Creating images on Sora », sur help.openai.com (consulté le ).
- ↑ (en) William Brangham, « The potentially dangerous implications of an AI tool creating extremely realistic video (transcript) », PBS, .
- ↑ Grégory Genevrier, « Intelligence artificielle: un faux coup d’État en Espagne agite les réseaux », RFI, (lire en ligne
). - ↑ (en-US) Sarah Perez, « OpenAI's Sora soars to No. 1 on Apple's US App Store », sur TechCrunch, (consulté le ).
- ↑ Michaël Szadkowski, « De Sora à Vibes : à quoi ressemble un réseau social dont le contenu est entièrement généré par IA ? », Le Monde, (lire en ligne
) - ↑ Nassim Chentouf, « Sora 2 est disponible : OpenAI autorise les deepfakes, une limite dangereuse franchie par l'IA », Les Numériques, (lire en ligne
) - ↑ (en) Benj Edwards, « OpenAI collapses media reality with Sora, a photorealistic AI video generator », Ars Technica, (lire en ligne
) - ↑ Matthieu Fabris, « Plusieurs éditeurs japonais demandent à OpenAI de ne plus utiliser leurs jeux vidéo pour entraîner Sora 2 », Numerama, (lire en ligne
) - ↑ (en) Frank Landymore, « Studio Ghibli Demands That OpenAI Stop Ripping Off Its Work », Futurism, (lire en ligne
) - ↑ (en) Amber V, « Sony’s Aniplex, Bandai Namco and other Japanese publishers demand end to unauthorized training of OpenAI’s Sora 2 through CODA », Automaton, (lire en ligne
) - ↑ Kesso Diallo, « Sora 2: les agences d'artistes et studios américains somment OpenAI de respecter leur propriété intellectuelle », BMFTV, (lire en ligne
) - ↑ Raphaël Raffray, « Sora 2: au cœur de polémiques, OpenAI bloque la création des vidéos représentant Martin Luther King », BFMTV, (lire en ligne
) - ↑ « OpenAI va renforcer le contrôle des droits d'auteur sur les vidéos générées par Sora 2 », Le Figaro, (lire en ligne
) - ↑ W.G.B, « Mickey, Dark Vador, Simba… Disney autorise OpenAI à utiliser 200 personnages pour des vidéos générées par l’IA », Le Figaro, (lire en ligne
) - ↑ Morgane Tual, « Des vidéos de célébrités mortes générées par IA sur le réseau social Sora choquent certains descendants », Le Monde, (lire en ligne
) - ↑ Basile Richard, « Sora 2 : cette nouvelle IA critiquée pour ses reproductions réalistes de célébrités mortes », Courrier International, (lire en ligne
) - ↑ Constance Vilanova, « Quand les morts célèbres hantent TikTok avec Sora 2 », France Info, (lire en ligne
) - ↑ Emma Ramont avec AFP, « Avec Sora 2, Open AI rend les deepfakes accessibles à tous (et ça fait paniquer Hollywood) », Le HuffPost, (lire en ligne
) - ↑ Maude Larin-Kieran, « Sora: une plateforme comme TikTok, mais avec du contenu généré à 100% par l'intelligence artificielle », Le Journal de Montréal, (lire en ligne
) - ↑ Jérémy Descours, « Pourquoi les vidéos deepfakes de Tibo InShape se multiplient sur les réseaux sociaux », RTL, (lire en ligne
) - ↑ Salomé Ferraris, « "N'importe qui peut exploiter son image en toute liberté": quand Tibo InShape autorise les internautes à créer des deepfakes de lui sur Sora 2, pour le meilleur et pour le pire », BFMTV, (lire en ligne
) - ↑ Morgane Tual, « Avec Sora, Tibo InShape au cœur d’un flot de vidéos racistes générées par IA », Le Monde, (lire en ligne
) - ↑ (en) Emanuel Maiberg, « OpenAI’s Sora 2 Floods Social Media With Videos of Women Being Strangled », 404 Media, (lire en ligne
) - ↑ Le Monde avec l'AFP, « OpenAI ferme son application vidéo Sora pour se recentrer sur les outils professionnels face à la concurrence d’Anthropic », Le Monde, (lire en ligne
)
Voir aussi
Articles connexes
- Modèle textuel-vidéo
- Veo (IA)
Liens externes
- (en) Site officiel
- Ressource relative à la musique :
- Portail de l’intelligence artificielle
- Portail de la robotique
- Portail de la linguistique