In dit tijdperk van politici die verslaafd zijn aan post-waarheid en de ad hominem-drogreden, heeft een nieuw project van de Universiteit van Washington algoritmen ontwikkeld die video's genereren met een zeer geavanceerde lip-synchronisatie, op basis van een eenvoudige audioclip. Het getrainde oog zal zonder moeite fouten in het proces ontdekken, maar dat is niet het punt. Uiteindelijk heb je alleen een simulatie nodig die goed genoeg is, en die herhaal je tot je er moe van wordt.

Nieuwe lip-sync-technologie kan video's 'verzinnen'
Obama

Een vleugje Orwell: de macht van het archief

Voor degenen die '1984' van George Orwell nog niet hebben gelezen: Winston Smith is een redacteur bij het Ministerie van Waarheid, belast met historisch revisionisme: het wijzigen van eerdere gegevens om ze aan te passen aan de visie en de wil van de staat. Tegenwoordig blijft de overtuiging dat 'niemand overleeft het archief' standhouden, maar als we de mogelijkheid om het archief te bewerken of helemaal opnieuw te creëren, die digitalisering biedt, erbij optellen, wordt het veel moeilijker om waarheid van leugens te onderscheiden. Dat gezegd hebbende, laat een nieuw project van de Universiteit van Washington de verbazingwekkende kracht van neurale netwerken zien, toegepast op visuele verwerking en lip-synchronisatie. Het laat ons ook bezorgd achter.

Hoe de technologie werkt

Kort gezegd genereert de software nauwkeurige lip- en mondbewegingen uit een audioclip, en plaatst die vervolgens op het gezicht van een persoon in een bestaande video. De verantwoordelijken voor het project zeggen dat deze 'realistische audio-naar-video conversie' praktische toepassingen heeft, zoals het optimaliseren van videoconferenties (in plaats van een heel videosignaal te verzenden, ontvang je alleen de audio en 'spreekt' een lokaal model tot je), of in de niet al te verre toekomst het voeren van gesprekken met historische figuren en acteurs via virtual reality. Waarom kozen ze voor Barack Obama? Een kwestie van beschikbaar materiaal: het neurale netwerk moet getraind worden, en er is een enorme hoeveelheid video's van de voormalige president in het publieke domein.

Nog niet perfect, maar veelbelovend

Nee, de synchronisatie is niet perfect en de makers weten dat ook, maar het is een kwestie van tijd voordat de effecten van het Valley van het Onbehaaglijke achter ons liggen. Momenteel kan het neurale netwerk alleen getraind worden met de gegevens van één persoon tegelijk. Volgens professor en co-auteur Steve Seitz is 'het niet mogelijk' om de stem van wie dan ook te nemen en die om te zetten in een video van president Obama. Maar als we afgaan op de reacties bij de video's (één heeft ze al uitgeschakeld), denken mensen daar anders over.

Officiële aankondiging: