AI & computingGeneratieve AI & synthetische media

OpenAI lanceert Sora 2: nepvideo's op een TikTok-achtig platform

· 2 min leestijd

Generatieve AI & synthetische media
Beeld: The Verge

OpenAI heeft Sora 2 gelanceerd, een nieuwe versie van zijn AI-videogenerator, samen met een sociale app die sterk op TikTok lijkt. Gebruikers kunnen er realistische video's mee maken van zichzelf en anderen, compleet met synchroon gesproken tekst. De techniek is zo overtuigend dat het steeds moeilijker wordt om echte beelden van nep te onderscheiden.

OpenAI presenteerde deze week Sora 2, de nieuwe versie van zijn videogenerator. Het bedrijf noemt het zelf het "ChatGPT-moment voor videogeneratie". Waar de eerste versie van Sora, die eind 2024 uitkwam, nog onvoorspelbaar was, produceert de nieuwe versie volgens OpenAI veel consistentere resultaten die beter aansluiten bij wat gebruikers vragen.

Het grootste verschil met de vorige versie is geluid. Sora 2 genereert niet alleen beeld, maar ook audio die precies synchroon loopt met de video, inclusief gesproken dialoog in meerdere talen. Journalisten van The Verge kregen tijdens een demonstratie clips te zien van bewegende personen die vloeiend spraken, met kloppende spraak-naar-lipsynchronisatie. Volgens OpenAI is het model ook veel beter geworden in het naspelen van natuurkundige wetten, zoals de manier waarop water beweegt of hoe een lichaam een salto maakt.

Een sociale app vol AI-gezichten

Naast het model lanceerde OpenAI ook een gelijknamige app: Sora. Die lijkt qua opzet sterk op TikTok, met een verticale scroll-feed vol kortere video's. De opvallendste functie heet "Cameo": gebruikers nemen kort zichzelf op terwijl ze hun hoofd bewegen en cijfers uitspreken, waarna hun gezicht en stem door anderen gebruikt kunnen worden in nieuwe, door AI gegenereerde video's. Zo kunnen vrienden elkaar bijvoorbeeld in absurde scenario's laten opduiken, simpelweg door een tekstopdracht te typen.

De app is voorlopig alleen op uitnodiging beschikbaar op iOS in de Verenigde Staten en Canada. Gebruikers kunnen zelf bepalen wie hun gezicht mag gebruiken: niemand, alleen goedgekeurde personen, wederzijdse volgers, of iedereen. Ze kunnen op elk moment toegang intrekken of een video met hun gezicht laten verwijderen.

Hoe herken je straks nog wat echt is?

Dat zulke overtuigende deepfakes zo laagdrempelig te maken zijn, roept meteen vragen op. OpenAI zegt dat elke video die met Sora wordt gemaakt herkenbare kenmerken bevat, zoals metadata en een bewegend watermerk, aangevuld met interne detectietools om AI-content te herkennen. Schermopnames binnen de app zijn bovendien geblokkeerd. Toch tonen eerdere ervaringen met andere AI-tools dat gebruikers dit soort beperkingen vaak weten te omzeilen.

Voor bekende publieke figuren geldt een aparte regel: hun gezicht mag alleen gebruikt worden als ze zelf een Cameo hebben aangemaakt en daarmee toestemming hebben gegeven. Vrij typen van een naam om willekeurige beelden van een bekend persoon te genereren is niet mogelijk, aldus OpenAI-medewerkers. Het bedrijf past daarnaast contentmoderatie toe om expliciete of aanstootgevende content tegen te houden, al is dat systeem in het verleden bij vergelijkbare tools, zoals bij stemdeepfakes en beeldgeneratoren van andere bedrijven, niet waterdicht gebleken.

Ook over auteursrecht bestaat onduidelijkheid. Volgens The Wall Street Journal zou Sora standaard auteursrechtelijk beschermd materiaal mogen gebruiken, tenzij rechthebbenden zich actief afmelden. OpenAI wilde daar tijdens de persbriefing geen directe uitspraak over doen, en verwees naar het bestaande beleid voor zijn beeldgenerator.

Achtergrond & begrippen

Wat betekent dit voor de toekomst? Sora 2 maakt het maken van overtuigende nepvideo's toegankelijk voor een breed publiek, wat de grens tussen echte en verzonnen beelden verder vervaagt. Dat vergroot het risico op verspreiding van desinformatie en misbruik van iemands gezicht of stem, maar dwingt platforms en gebruikers ook om sneller na te denken over herkenning en controle van AI-content.

Sora 2
De nieuwste versie van OpenAI's AI-model dat video's met synchroon geluid en dialoog kan genereren op basis van een tekstopdracht.
Cameo
Een functie in de Sora-app waarmee gebruikers hun eigen gezicht en stem laten vastleggen, zodat anderen daarmee nieuwe AI-video's kunnen maken.
Watermerk
Een zichtbaar of onzichtbaar kenmerk dat aan een bestand wordt toegevoegd om te laten zien dat het door AI is gemaakt.
Metadata
Onzichtbare technische informatie die aan een bestand vastzit, zoals wanneer en waarmee een video is gemaakt.

Bronnen

Dit artikel is met behulp van AI geschreven op basis van bovenstaande bronnen en is geen letterlijke vertaling. Zo werkt onze redactie.

Meer over Generatieve AI & synthetische media