Die Technologie wächst weiterhin sprunghaft und stützt sich auf verschiedene Bereiche, um neue Fähigkeiten und Funktionen zu erkunden. Eine davon besteht darin, das Gesicht einer Person durch ein Stimmfragment „rekonstruieren“ zu können.
Die Speech2Face-Studie, die 2019 auf einer Konferenz für Vision- und Erkennungsmuster vorgestellt wurde, zeigte, dass eine künstliche Intelligenz (KI) das Erscheinungsbild einer Person durch kurze Audiosegmente entziffern kann.
Das Papier erklärt, dass das Ziel der Forscher Tae-Hyun On, Tali Dekel, Changil Kim, Inbar Mosseri, William T. Freeman und Michael Rubinstein vom MIT Research and Science Program nicht darin besteht, die Gesichter der Menschen identisch zu rekonstruieren, sondern ein Bild mit den physikalischen Eigenschaften zu erstellen, die mit dem analysierte Audio.
Um dies zu erreichen, haben sie ein tiefes neuronales Netzwerk verwendet, entworfen und trainiert, das Millionen von Videos von YouTube analysiert hat, in denen Menschen sprechen. Während des Trainings lernte das Modell, Stimmen mit Gesichtern zu korrelieren, sodass es Bilder mit physischen Eigenschaften erzeugen konnte, die den Sprechern ähneln, einschließlich Alter, Geschlecht und ethnischer Zugehörigkeit.
Das Training wurde unter Aufsicht und unter Verwendung der Übereinstimmung der Gesichter und Stimmen von Internetvideos durchgeführt, ohne dass detaillierte körperliche Merkmale des Gesichts modelliert werden mussten.
Sie erläuterten, dass, da diese Studie sowohl ethnische als auch datenschutzsensible Aspekte aufweisen könnte, der Wiederherstellung von Gesichtern keine spezifischen physischen Aspekte hinzugefügt wurden und sie versichern, dass sie sich wie jedes andere System des maschinellen Lernens im Laufe der Zeit verbessert, da bei jedem Gebrauch erweitert seine Wissensbibliothek.
Während die Tests zeigten, dass Speech2Face eine hohe Anzahl von Übereinstimmungen zwischen Gesichtern und Stimmen aufweist, wies es auch einige Mängel auf, bei denen ethnische Zugehörigkeit, Alter oder Geschlecht nicht mit der verwendeten Sprachprobe übereinstimmten.
Das Modell wurde entwickelt, um statistische Korrelationen zwischen Gesichtszügen und der Stimme darzustellen. Es sollte daran erinnert werden, dass KI durch YouTube-Videos gelernt wurde, die keine echte Stichprobe der Weltbevölkerung darstellen, beispielsweise in einigen Sprachen Abweichungen von den Trainingsdaten zeigt.
In diesem Sinne empfiehlt die Studie selbst, am Ende ihrer Ergebnisse, dass diejenigen, die sich für die Erforschung und Modernisierung des Systems entscheiden, eine breitere Auswahl an Personen und Stimmen in Betracht ziehen, damit maschinelles Lernen ein breiteres Repertoire an übereinstimmenden und neu erstellten Gesichtern bietet.
Das Programm war auch in der Lage, die Stimme in Cartoons nachzubilden, die auch den Stimmen der analysierten Audios eine unglaubliche Ähnlichkeit haben.
Da diese Technologie auch für böswillige Zwecke verwendet werden kann, bleibt die Wiederherstellung des Gesichts nur so nah an der Person und gibt keine vollständigen Gesichter, da dies ein Problem für die Privatsphäre der Menschen darstellen könnte. Dennoch war es überraschend, was Technologie aus Audiobeispielen leisten kann.
LESEN SIE WEITER:
Más Noticias
Temblor hoy en México: Noticias de la actividad sísmica este sábado 19 de abril de 2025
Sigue en vivo todas las actualizaciones sobre movimientos telúricos emitidas por el SSN

Decenas de personas comparecen ante un tribunal de Estambul acusadas de participar en protestas tras el arresto de Ekrem Imamoglu
Un total de 189 personas comenzaron este sábado su defensa en un primer juicio relacionado con estos hechos. A las acusaciones por participación en protestas ilícitas se suman, en algunos casos, cargos por desacato a la autoridad y tenencia de armas

Tris: todos los números ganadores del 18 de abril
Enseguida los resultados de todos los sorteos de Tris dados a conocer por la Lotería Nacional y averigue si ha sido uno de los ganadores

Gobierno de Ecuador acusa presunto traslado de sicarios desde México para atentar contra Daniel Noboa
Las fuerzas armadas ecuatorianas emitieron un comunicado en el que detallaron sobre el aumento de seguridad para proteger al presidente

Prepárate antes de salir: conoce el pronóstico del clima en Mendoza
Para evitar cualquier imprevisto es importante conocer el pronóstico del tiempo
