Wenn Realität manipulierbar wird – zur demokratischen Relevanz von Deepfakes
Wir schreiben das Jahr 2022. Europa befindet sich im Ausnahmezustand. Russische Truppen sind in die Ukraine einmarschiert, Städte werden bombardiert, Millionen Menschen fliehen. Inmitten dieser Situation taucht plötzlich ein Video auf.
Der ukrainische Präsident Volodymyr Zelenskyj richtet sich an seine Bevölkerung. Seine Botschaft scheint eindeutig: Der Widerstand sei zwecklos, die Ukraine solle die Waffen niederlegen.
Für einen kurzen Moment wirkt das Video wie eine historische Zäsur. Hat die Ukraine tatsächlich kapituliert? Doch die vermeintliche Realität zerfällt ebenso schnell, wie sie entstanden ist. Das Video ist gefälscht.
Es handelt sich um einen sogenannten Deepfake; ein mithilfe künstlicher Intelligenz manipuliertes Video, in dem eine reale Person scheinbar Aussagen trifft, die sie nie getätigt hat. Der Versuch, Zelenskyj digital zur Kapitulation zu bewegen, gilt heute als eines der ersten prominenten Beispiele für den gezielten Einsatz solcher Technologien im geopolitischen Kontext. Überraschend kam dies jedoch nicht. Angesichts der rasanten Entwicklung künstlicher Intelligenz war es letztlich nur eine Frage der Zeit, bis Deepfakes auch als politisches Instrument eingesetzt werden würden.
Was bleibt, ist eine grundlegende Frage: Was geschieht mit politischer Wahrheit, wenn Realität manipulierbar wird?
Visuelle Evidenz und die Logik des Vertrauens
Moderne Mediengesellschaften folgen einem impliziten Grundsatz: Seeing is believing. Was sichtbar ist, erscheint glaubwürdiger als das bloß Beschriebene. Gerade audiovisuelle Inhalte entfalten eine besondere Überzeugungskraft, weil sie unmittelbarer wirken als Text.
Genau an diesem Punkt setzen Deepfakes an. Sie nutzen die Autorität des visuellen Mediums, um Vertrauen zu erzeugen. Selbst dann, wenn der Inhalt vollständig konstruiert ist.
Eine Studie von Matthew Groh untersucht, wie zuverlässig Menschen zwischen echten und manipulierten politischen Reden unterscheiden können. In mehreren Experimenten mit insgesamt 2.215 Teilnehmer:innen wurden reale und künstlich erzeugte Inhalte in unterschiedlichen Formaten, als Text, Audio und Video, präsentiert.[1]
Die Ergebnisse zeichnen ein differenziertes Bild: Menschen sind grundsätzlich in der Lage, Deepfakes zu erkennen, doch ihre Urteilsfähigkeit erweist sich als deutlich weniger verlässlich, als man es erwarten würde. Zwar gelingt die Unterscheidung besser als reines Raten, von einer zuverlässigen Einschätzung kann jedoch keine Rede sein.[2]
Besonders aufschlussreich ist die Rolle der medialen Darstellung: Je mehr Sinneseindrücke zur Verfügung stehen, insbesondere durch die Kombination von Audio und Video, desto eher gelingt es den Teilnehmenden, Manipulation zu erkennen.[3] Gleichzeitig zeigt die Studie, dass Menschen stärker auf Stimme, Mimik und visuelle Dynamik reagieren als auf den eigentlichen Inhalt einer Aussage.[4]
Die Konsequenz ist bemerkenswert: Nicht das Gesagte steht im Zentrum der Bewertung, sondern die Art und Weise, wie es vermittelt wird. Vertrauen verschiebt sich damit von der rationalen Analyse hin zu wahrnehmungsbasierten Eindrücken. Ein Umstand, der gezielt ausgenutzt wird.
Deepfakes als Instrument politischer Einflussnahme
Die politische Brisanz von Deepfakes liegt weniger in ihrer bloßen Existenz als in ihrem potenziellen Einsatz und damit in ihrer Überzeugungskraft.
Es bedarf keiner Vielzahl an Fälschungen, um Wirkung zu entfalten. Ein einzelnes, überzeugend gestaltetes Video kann ausreichen, um Verunsicherung zu erzeugen, öffentliche Diskurse zu beeinflussen oder bestehendes Vertrauen nachhaltig zu beschädigen.
Gerade in politisch sensiblen Situationen, etwa während Wahlen oder bewaffneter Konflikte, kann ein solcher Inhalt erhebliche Konsequenzen nach sich ziehen. Selbst wenn sich ein Video im Nachhinein als Fälschung herausstellt, bleibt die ursprüngliche Wirkung oft bestehen.
Die Forschung weist darauf hin, dass insbesondere hochrealistische Deepfakes, die nicht nur algorithmisch generiert, sondern zusätzlich professionell bearbeitet wurden, deutlich schwerer zu identifizieren sind als einfachere Manipulationen. Damit verschiebt sich die Problematik von der Masse zur Qualität: Entscheidend ist nicht die Anzahl der Fakes, sondern ihre Überzeugungskraft.
Das Problem der „erodierenden Wahrheit“
Deepfakes stellen nicht nur eine technologische, sondern auch eine erkenntnistheoretische Herausforderung dar.
Diese Entwicklung steht jedoch nicht für sich allein. Schon in den vergangenen Jahren ist der faktenbasierte Diskurs zunehmend unter Druck geraten; nicht zuletzt durch Desinformation und die Dynamiken sozialer Medien. Deepfakes verstärken diese Entwicklung nun zusätzlich.
Wenn audiovisuelle Inhalte nicht mehr verlässlich zwischen Realität und Konstruktion unterscheiden lassen, gerät eine zentrale Grundlage demokratischer Öffentlichkeit ins Wanken. Öffentliche Debatten basieren auf der Annahme, dass Fakten überprüfbar und Evidenzen nachvollziehbar sind. Doch genau diese Annahme wird durch Deepfakes infrage gestellt.
Paradoxerweise liegt die größte Gefahr nicht zwingend darin, dass Menschen gefälschte Inhalte glauben. Viel gravierender könnte sein, dass echte Inhalte zunehmend angezweifelt werden. Dieses Phänomen wird als Liar’s Dividend bezeichnet: Die bloße Existenz von Deepfakes ermöglicht es, authentische Aufnahmen als manipuliert darzustellen.
Die Folge ist eine schleichende Erosion von Vertrauen. Wenn jede Aufnahme potenziell gefälscht sein könnte, verliert visuelle Evidenz ihre Beweiskraft und damit auch ihre gesellschaftliche Funktion.
Regulierung zwischen Anspruch und Realität
Die Europäische Union hat auf diese Entwicklungen reagiert und mit dem Artificial Intelligence Act erstmals einen umfassenden Rechtsrahmen für den Einsatz von KI geschaffen. Ein zentraler Bestandteil betrifft die Transparenzpflicht: Inhalte, die mithilfe künstlicher Intelligenz erzeugt oder manipuliert wurden, müssen künftig entsprechend gekennzeichnet werden.[5] Ziel ist es, Nutzer:innen eine informierte Einordnung zu ermöglichen.
Dieser Ansatz verfolgt ein nachvollziehbares Prinzip: Transparenz soll Täuschung verhindern.
Doch die praktische Umsetzung wirft Fragen auf. Kennzeichnungen greifen nur dann, wenn sie tatsächlich wahrgenommen werden und wenn Inhalte nicht bereits zuvor unkontrolliert verbreitet wurden. In einer digitalen Öffentlichkeit, die von Geschwindigkeit und Viralität geprägt ist, lassen sich diese Voraussetzungen jedoch kaum gewährleisten.
Die Herausforderung der digitalen Öffentlichkeit
Die Problematik beschränkt sich jedoch nicht auf politische Kommunikation.
Mit der zunehmenden Verbreitung generativer KI-Tools verschwimmen auch im privaten Bereich die Grenzen zwischen Kontrolle und Kontrollverlust. Bilder, die etwa auf Plattformen hochgeladen oder in KI-Systeme eingespeist werden, können potenziell weiterverarbeitet, verändert und auf externen Seiten erneut verbreitet werden, oft ohne Wissen oder Zustimmung der betroffenen Personen.
Dabei geht es nicht nur um klassische Deepfakes, sondern auch um eine breitere Form der digitalen Zweckentfremdung. Fotos können in neue Kontexte gesetzt, verändert oder missbräuchlich verwendet werden. In manchen Fällen tauchen solche Inhalte auf schwer nachvollziehbaren oder unseriösen Plattformen auf, wie beispielsweise auf Pornowebsiten.
Die technische Möglichkeit, visuelle Identität zu reproduzieren, wirft damit auch Fragen des Persönlichkeitsschutzes und der informationellen Selbstbestimmung auf.
Das Leben in einer synthetischen Realität
Deepfakes sind kein vorübergehendes Phänomen. Sie markieren vielmehr einen Übergang in eine neue Phase digitaler Kommunikation. Eine Phase, in der Realität nicht mehr nur abgebildet, sondern aktiv konstruiert werden kann.
Zukünftig ist zu erwarten, dass solche Technologien weiter an Qualität gewinnen und gleichzeitig leichter zugänglich werden. Die Erstellung täuschend echter Inhalte könnte damit nicht länger spezialisierten Akteur:innen vorbehalten sein, sondern Teil alltäglicher digitaler Praxis werden.
Vor diesem Hintergrund verschiebt sich die Verantwortung. Sie liegt nicht allein bei Gesetzgebern oder Technologieunternehmen, sondern zunehmend auch bei den Nutzer:innen selbst. Medienkompetenz, kritisches Denken und die Fähigkeit zur Einordnung von Informationen werden zu zentralen Voraussetzungen für die gesellschaftliche Teilhabe.
Die entscheidende Frage lautet daher nicht mehr, ob wir Deepfakes verhindern können. Vielmehr stellt sich die Frage, wie wir in einer Welt bestehen, in der Wirklichkeit jederzeit manipulierbar ist und welche Formen von Vertrauen in einer solchen Welt überhaupt noch möglich sind.
[1] Vgl. Groh et al., 2024.
[2] Vgl. Groh et al., 2024.
[3] Vgl. Groh et al., 2024.
[4] Vgl. Groh et al., 2024.
[5] Vgl. EU AI Act
Illustration: generiert mit ChatGPT



