Ein Deepfake ist ein synthetischer Inhalt – Video, Bild oder Audio –, der mithilfe von Techniken der künstlichen Intelligenz, in der Regel generativen gegnerischen Netzwerken (GAN) oder Diffusionsmodellen, erstellt oder manipuliert wurde, um das Gesicht, die Stimme oder die Gestik einer Person hyperrealistisch zu imitieren. Das Ergebnis kann jemanden zeigen, der Dinge sagt oder tut, die nie stattgefunden haben, und zwar mit einem Grad an Glaubwürdigkeit, der die Unterscheidung von authentischem Material erschwert.
Seine Bedeutung ist zweifach. Einerseits bietet es legitime Einsatzmöglichkeiten in den Bereichen Film, Synchronisation, Barrierefreiheit oder audiovisuelle Restaurierung. Andererseits birgt es ernsthafte Risiken:
- Desinformation sowie politische oder mediale Manipulation.
- Identitätsdiebstahl bei Betrug und Täuschung (zum Beispiel das Klonen von Stimmen zur Autorisierung von Zahlungen).
- Verletzung der Privatsphäre, insbesondere durch nicht einvernehmliche sexuelle Inhalte.
In der Praxis wird deren Erkennung immer komplexer, obwohl es Werkzeuge gibt, die Inkonsistenzen beim Blinzeln, bei der Beleuchtung oder bei digitalen Artefakten analysieren. Regulatorische Tendenzen, wie das EU-KI-Gesetz, fordern die Kennzeichnung dieser Art von Inhalten, um die Nutzenden zu schützen.