Fake-Fotos & KI-Bilder
Deepfake erkennen: Warnsignale bei Video, Stimme und Anruf
Deepfake erkennen: An diesen Warnsignalen erkennst du gefälschte Videos und KI-Stimmen, warum Apps oft irren und welcher Rückruf dich wirklich schützt.

Einen Deepfake erkennst du selten sicher am Bild allein. Achte auf Warnsignale wie unscharfe Übergänge am Gesichtsrand, Lippen, die nicht zum Ton passen, oder eine blecherne, monotone Stimme. Noch wichtiger ist der Zusammenhang: Verlangt jemand per Videoanruf, Anruf oder Sprachnachricht Geld oder Daten, leg auf und ruf die Person unter ihrer gespeicherten Nummer zurück.
Deepfakes sind mit künstlicher Intelligenz gefälschte Videos, Bilder und Tonaufnahmen. Kriminelle nutzen sie, um sich als Angehörige, Vorgesetzte oder Prominente auszugeben. Wir entwickeln bei TrustCamera eine Kamera-App, die Aufnahmen schon beim Entstehen mit einem Prüfcode versieht. Deshalb wissen wir, wie wenig sich einer fertigen Datei nachträglich ansehen lässt. Hier findest du die Warnsignale, die BSI und Polizei nennen, ihre Grenzen und die Gegenproben, die auch bei perfekten Fälschungen wirken.
Deepfake erkennen: die wichtigsten Schritte im Überblick
Um einen Deepfake zu erkennen, kombinierst du zwei Dinge: den Blick auf typische Fehler in Bild und Ton und eine Gegenprobe über einen zweiten Weg. Solche Fehler zu finden, wird laut BSI immer schwieriger. Ein Rückruf unter einer bekannten Nummer, eine persönliche Frage oder ein Codewort funktionieren dagegen auch bei perfekten Fälschungen.
- Innehalten: Drängt dich jemand zu einer schnellen Zahlung oder will vertrauliche Daten, ist das das stärkste Warnsignal, egal wie echt Gesicht und Stimme wirken.
- Genau hinsehen und hinhören: Achte auf Gesichtsrand, Zähne, Augen und Lippen und auf eine blecherne oder monotone Stimme.
- Über einen zweiten Weg prüfen: Leg auf und ruf die Person unter ihrer gespeicherten Nummer zurück.
- Persönlich nachfragen: Stell eine Frage, deren Antwort nicht im Netz steht, oder frag nach dem vereinbarten Familien-Codewort.
- Quelle prüfen: Bei Videos aus sozialen Netzwerken schaust du, wer sie verbreitet und ob seriöse Medien darüber berichten.
Die Schritte 3 und 4 sind die wichtigsten, weil sie unabhängig davon wirken, wie gut eine Fälschung gemacht ist. Geht es nicht um ein Video, sondern um ein einzelnes Foto, helfen dir die sieben Methoden aus unserem Ratgeber Bild auf Echtheit prüfen weiter.
Was Deepfakes sind und welche Arten es gibt
Hinter dem Sammelbegriff stecken verschiedene KI-Verfahren, die Gesichter und Stimmen fälschen oder ganz neu erzeugen. Das Bundesamt für Sicherheit in der Informationstechnik (BSI) beschreibt sie ausführlich. Für den Alltag reicht es, vier Formen zu kennen:
- Gesichtstausch (Face Swapping): Das Gesicht einer Person wird in ein fremdes Video eingesetzt, Mimik und Blickrichtung bleiben erhalten. Laut BSI genügen dafür wenige Minuten Videomaterial der Zielperson, manche Modelle arbeiten sogar in Echtzeit.
- Gesteuerte Mimik (Face Reenactment): Kopfbewegung, Mimik oder Lippen einer echten Person werden manipuliert. So entstehen Videos, in denen jemand Sätze sagt, die er nie gesagt hat.
- Erfundene Gesichter: Die KI erzeugt Menschen, die es nicht gibt. Gängige Verfahren beschränken sich laut BSI bisher meist auf Einzelbilder.
- Geklonte Stimmen: Text-to-Speech liest beliebigen Text mit der Stimme einer Zielperson vor, Voice Conversion verwandelt eine gesprochene Aufnahme in ihre Stimme.
Für eine hochwertige Stimmfälschung braucht es laut BSI mehrere Stunden Trainingsmaterial. Mit Hilfsdaten anderer Sprecher lässt sich das auf wenige Minuten verkürzen, und die Forschung arbeitet an Verfahren, denen wenige Sekunden reichen. Das BSI geht davon aus, dass die benötigte Datenmenge weiter sinkt.
Erfundene Gesichter tauchen vor allem auf Profilfotos auf. Wie du solche Standbilder entlarvst, erklärt unser Artikel KI-Bild erkennen. Und nicht jede Fälschung braucht KI: Oft wird ein echtes Video aus dem Zusammenhang gerissen oder ein Foto klassisch retuschiert. Woran du Letzteres siehst, zeigt der Ratgeber bearbeitete Bilder erkennen.
Deepfake-Videos erkennen: Warnsignale in Gesicht und Bewegung
Viele Fälschungsverfahren hinterlassen sichtbare Fehler, sogenannte Artefakte. Das BSI beschreibt die typischen Artefakte beim Gesichtstausch, die Polizeiliche Kriminalprävention ergänzt Hinweise zu Bewegung und Bildqualität. Wenn möglich, halte das Video an, vergrößere es und achte auf diese Stellen:
- Gesichtsrand: Am Übergang zwischen eingesetztem Gesicht und Kopf wechseln Hautfarbe oder Hautstruktur. Manchmal blitzen in einzelnen Bildern Teile des Originalgesichts auf, etwa doppelte Augenbrauen.
- Zähne und Augen: Scharfe Konturen wirken bei genauem Hinsehen verwaschen.
- Kopfdrehung: Die Seitenansicht lernen viele Modelle schlecht. Dreht sich der Kopf stark, wird das Gesicht oft unscharf.
- Mimik und Licht: Die Mimik wirkt eingeschränkt, Licht und Schatten im Gesicht passen nicht zur Umgebung.
- Blinzeln und Bewegung: Die Person blinzelt zu rhythmisch oder bewegt sich auffällig starr.
- Bildqualität: Das Gesicht ist schärfer oder unschärfer als Körper und Hintergrund.
Bei Live-Videoanrufen hast du einen kleinen Vorteil. Ein Angreifer kann fehlerhaftes Material in Echtzeit nicht nachträglich bereinigen, darauf weist das BSI ausdrücklich hin. Achte deshalb besonders auf Momente, in denen sich dein Gegenüber stark bewegt oder den Kopf zur Seite dreht. Die Polizei nennt zusätzlich Lippenbewegungen, die nicht genau zum Ton passen.
Die Grenze: Diese Liste beschreibt Fehler, die mit jeder neuen Modellgeneration seltener werden. Findest du keine Artefakte, ist ein Video deshalb noch lange nicht echt. Viele Clips in sozialen Netzwerken sind außerdem oft so stark komprimiert, dass feine Details ohnehin verschwimmen. Deepfake-Videos erkennst du deshalb eher am Kontext: Wer hat den Clip zuerst veröffentlicht, und berichten seriöse Medien darüber? Ein Standbild aus dem Video kannst du zusätzlich per Bilder-Rückwärtssuche prüfen, um ältere Fassungen oder das Original zu finden.
KI-Stimme erkennen: Warnsignale am Telefon
Geklonte Stimmen sind für Betrüger besonders bequem, weil ein Anruf keine Bildfehler zeigt. Das BSI nennt dennoch einige typische Schwächen synthetischer Stimmen:
- Metallischer Klang: Die Stimme wirkt blechern oder künstlich.
- Monotone Betonung: Sätze klingen gleichförmig, ohne natürliche Satzmelodie.
- Falsche Aussprache: Einzelne Wörter werden falsch ausgesprochen, Akzent oder Betonung passen nicht zur echten Person.
- Seltsame Geräusche: Bei Pausen oder sehr langen Sätzen entstehen unnatürliche Laute.
- Verzögerung: Hochwertige Fälschungen antworten oft mit einer kleinen Verzögerung.
Die Polizeiliche Kriminalprävention beschreibt dieselben Anzeichen aus Sicht der Betroffenen. Eine vertraute Person klingt im Anruf oder in der Sprachnachricht sehr blechern oder unnatürlich. Dazu kommt eine vorgetäuschte emotionale Notsituation, die dich zu einer schnellen Überweisung drängen soll.
Auf den Klang allein solltest du dich nicht verlassen. Eine schlechte Handyverbindung klingt ebenfalls blechern, und gute Stimmklone klingen natürlich. Aussagekräftiger ist das Muster hinter dem Anruf: eine bekannte Stimme, eine plötzliche Notlage und Zeitdruck. Wer eine KI-Stimme erkennen will, achtet deshalb weniger auf den Ton als auf die Forderung.

Deepfake-Erkennung per App: warum Tools oft danebenliegen
Für Videos und Tonaufnahmen gibt es Apps und Online-Tools, die Deepfakes automatisch erkennen sollen. Das Ergebnis ist eine Wahrscheinlichkeit, kein Beweis. Wie zuverlässig ein bestimmtes Tool arbeitet, kannst du von außen kaum beurteilen.
Wie schwer die automatische Erkennung ist, zeigt ein Wettbewerb, auf den das BSI verweist. In der Deepfake Detection Challenge 2020 erreichte selbst das beste Modell im Schnitt nur 65,18 Prozent Genauigkeit, bloßes Raten hätte 50 Prozent ergeben. Das Grundproblem nennt das BSI mangelnde Generalisierbarkeit: Ein Detektor erkennt vor allem Fälschungen, die seinen Trainingsdaten ähneln.
Hinzu kommt, dass Fälscher gezielt gegen Detektoren arbeiten können. Laut BSI lässt sich ein Rauschen über ein manipuliertes Bild legen, das Menschen nicht bemerken, das die Erkennung aber aushebelt. Auch die Polizeiliche Kriminalprävention schreibt, es sei teils sehr schwierig, Fakes von echten Inhalten zu unterscheiden, selbst für andere KIs.
Nutze Apps, die Deepfakes erkennen sollen, deshalb höchstens als Zusatzindiz. Meldet ein Tool „wahrscheinlich gefälscht“, ist das ein Grund für einen Rückruf. Ein „wahrscheinlich echt“ ist dagegen keine Entwarnung. Deepfake-Quizze und Tests im Netz sind trotzdem sinnvoll: Laut BSI kann das Wissen um typische Artefakte die Erkennung deutlich verbessern. Den Rückruf im Ernstfall ersetzen sie nicht.
Der beste Schutz: die Identität über einen zweiten Weg prüfen
Weil sich gute Deepfakes kaum erkennen lassen, setzt die Polizei auf Gegenproben, die keine Technik brauchen. Die Polizeiliche Kriminalprävention rät bei Deepfake-Betrug zu drei Schritten:
- Auflegen und zurückrufen: Leg im Zweifel auf oder trenne die Verbindung und ruf die Person über ihre normale, gespeicherte Telefonnummer zurück.
- Persönliche Frage stellen: Frag etwas, das nur die echte Person beantworten kann und das nicht öffentlich bekannt ist oder sich leicht recherchieren lässt.
- Codewort vereinbaren: Legt in der Familie ein Codewort für echte Notfälle fest, das eine KI nicht kennen kann.
Die Polizei fasst das in ihrer SHS-Regel zusammen: Stoppen, Hinterfragen, Schützen. Stoppen heißt, auch bei einer bekannten Stimme innezuhalten, wenn plötzlich und dringend Geld gefordert wird. Hinterfragen heißt, über die offiziell bekannte Nummer zurückzurufen. Schützen heißt, Sicherheitscodes oder Rückrufregeln einzuführen, in der Familie wie im Job.
Das Codewort hat aus unserer Sicht das beste Verhältnis von Aufwand und Nutzen. Es kostet ein kurzes Gespräch und wirkt auch gegen eine perfekte Fälschung. Am besten vereinbart ihr es persönlich statt im Familienchat und überlegt vorher, wer im Notfall danach fragt.
Dir ist die Rückfrage unangenehm? Echte Angehörige und Vorgesetzte verstehen, wenn du kurz auflegst und zurückrufst. Betrüger versuchen dagegen, genau das zu verhindern, meist mit Zeitdruck.
Typische Deepfake-Maschen: Promi-Werbung, Chef-Anruf, Familien-Notfall
Deepfakes tauchen selten allein auf. Sie sind meist Teil einer bekannten Betrugsmasche, die durch das echte Gesicht oder die echte Stimme glaubwürdiger wirkt. Diese Varianten beschreibt die Polizei:
Promi-Werbung für Geldanlagen: In Anzeigen auf Websites und in Social-Media-Apps bürgen scheinbar Prominente für Anlagen mit ungewöhnlich hohen Renditen. Laut Polizeilicher Kriminalprävention sind diese Inhalte oft KI-generiert, oder es werden Bilder ohne Einverständnis der Abgebildeten missbraucht. Hohe Gewinne ohne Risiko gibt es nicht, egal wer sie verspricht.
Videoanruf vom Chef: Die Polizei schildert als Beispiel den Videoanruf vom angeblichen Chef, der dich zu einer dringenden Zahlung drängt. Die Stimme wirkt glaubwürdig, ist aber künstlich erzeugt. Das BSI beschreibt dieselbe Masche als CEO-Fraud mit der gefälschten Stimme einer Führungskraft.
Notfall in der Familie: Eine vertraute Stimme meldet sich per Anruf oder Sprachnachricht, schildert eine Notlage und braucht sofort Geld. Das ist die bekannte Masche des Schockanrufs, nur mit geklonter Stimme.
Dating und Erpressung: Die Polizei hält es für denkbar, dass Love-Scammer Deepfake-Videochats nutzen, um Vertrauen aufzubauen und intimes Material für eine Erpressung zu bekommen. Auch hier hilft ein gesundes Misstrauen, wenn ein neuer Kontakt sehr schnell sehr persönlich wird. Wirst du bereits mit intimen Aufnahmen erpresst, hilft unser Ratgeber Sextortion: was tun.
Herkunftsnachweise: die langfristige Antwort auf Deepfakes
Alle bisherigen Methoden versuchen, einer fertigen Aufnahme ihre Echtheit anzusehen. Das BSI nennt deshalb einen zweiten Ansatz: kryptografische Verfahren, die eine Aufnahme fest an ihre Quelle binden, so dass spätere Manipulationen sofort auffallen. Aktuelle Entwicklungen arbeiten laut BSI an einer digitalen Signatur direkt beim Aufnehmen. Eine Grenze nennt das Amt gleich mit: Manipuliert die Quelle selbst das Material vorher, verhindert das keine Signatur.
Der bekannteste offene Standard dafür heißt C2PA. Er hängt Dateien sogenannte Content Credentials an, also signierte Angaben dazu, wann und mit welchem Gerät oder Programm eine Aufnahme erstellt und bearbeitet wurde. Laut der Content Authenticity Initiative machen sie nachträgliche Änderungen sichtbar. Ob ein Inhalt „echt“ ist, sollen sie ausdrücklich nicht festlegen.
Wir verfolgen mit TrustCamera dasselbe Ziel. Fotos und Videos entstehen direkt in der App, Uploads aus der Galerie sind nicht möglich. Bei Videos bis 20 Sekunden wird zu Beginn ein unsichtbarer Code eingebettet. Jede Aufnahme bekommt einen Prüfcode. Wer ihn hat, kann Echtheit, Aufnahmezeit und ungefähren Ort kostenlos im Browser prüfen, ohne Konto. Die App für Android und iOS erscheint in Kürze.
Wichtig ist, was ein solcher Nachweis zeigt und was nicht. Er belegt, dass eine Datei seit der Aufnahme unverändert ist. Ob die gefilmte Szene gestellt war, kann er nicht beurteilen, und bei einem Live-Videoanruf hilft er dir nicht. Für ein Video ohne Herkunftsnachweis bleiben die Warnsignale und vor allem der Rückruf.
Deepfake-Betrug: was du tun kannst, wenn es dich trifft
Hast du schon gezahlt oder Daten herausgegeben, ist schnelles Handeln entscheidend. Diese Schritte nennt die Polizeiliche Kriminalprävention für Betrug mit falschen Geldanlagen. Aus unserer Sicht passen sie auch zu anderen Deepfake-Maschen:
- Bank informieren: Kontaktiere sofort deine Bank oder den Zahlungsdienst, um Überweisungen zurückzurufen oder Konten zu sperren.
- Nichts nachzahlen: Überweise kein weiteres Geld, auch nicht für angebliche Gebühren oder Steuern, und brich den Kontakt ab.
- Beweise sichern: Mach Screenshots und speichere Chatverläufe, E-Mails, Kontoauszüge und Transaktionsnummern.
- Anzeige erstatten: Das geht bei jeder Polizeidienststelle oder über die Onlinewache deines Bundeslandes.
Rechne außerdem mit einem zweiten Versuch. Laut Polizei melden sich Täter oft später erneut, geben sich als Ermittler oder Anwälte aus und versprechen, dein Geld gegen eine Gebühr zurückzuholen.
Taucht dein eigenes Gesicht in einem Fake auf, rät die Polizeiliche Kriminalprävention, den Inhalt bei der Plattform zu melden und Anzeige zu erstatten. Sichere dazu die URL, das Veröffentlichungsdatum und die Uhrzeit des Abrufs, gern mit Screenshots. Die Ausnahme sind Darstellungen sexualisierter Gewalt oder Missbrauchsdarstellungen von Kindern, deren Besitz schon strafbar sein kann. Mach davon keine Screenshots und frag bei der Polizei nach, wie du Beweise sicherst.
Häufige Fragen zum Erkennen von Deepfakes
Kann man Deepfakes immer erkennen?
Nein. Viele Fälschungen zeigen noch Fehler an Gesichtsrand, Zähnen, Lippen oder Stimme, besonders in Live-Anrufen. Das BSI geht aber davon aus, dass die Erkennung mit bloßem Auge immer schwieriger wird. Verlässlicher als jedes Warnsignal ist deshalb eine Gegenprobe: auflegen, unter einer bekannten Nummer zurückrufen oder eine persönliche Frage stellen.
Gibt es eine App, die Deepfakes zuverlässig erkennt?
Nein. Apps und Online-Tools liefern eine Wahrscheinlichkeit, die stark von ihren Trainingsdaten abhängt. Mit neuen Fälschungsverfahren liegen sie oft daneben, und Fälscher können sie gezielt austricksen. Nutze ein solches Tool höchstens als zusätzlichen Hinweis. Ein Ergebnis wie „wahrscheinlich echt“ ist keine Entwarnung.
Woran erkenne ich eine KI-Stimme am Telefon?
Typische Anzeichen sind ein metallischer, blecherner Klang, eine monotone Betonung, falsch ausgesprochene Wörter und kleine Verzögerungen beim Antworten. Gute Stimmklone zeigen davon aber kaum etwas. Achte deshalb vor allem auf das Muster: bekannte Stimme, plötzliche Notlage, Zeitdruck und eine Geldforderung. Dann auflegen und selbst zurückrufen.
Wie hilft ein Codewort gegen Deepfake-Anrufe?
Ihr vereinbart in der Familie ein Wort, das nur ihr kennt und das nirgends online steht. Meldet sich jemand mit einem angeblichen Notfall, fragst du nach dem Codewort. Eine KI kann es nicht kennen, auch wenn sie die Stimme perfekt nachahmt. Die Polizeiliche Kriminalprävention empfiehlt ein solches Codewort ausdrücklich.
Können Deepfakes auch in Live-Videoanrufen vorkommen?
Ja. Laut BSI arbeiten manche Verfahren zum Gesichtstausch in Echtzeit, und die Polizei warnt vor Videoanrufen vom angeblichen Chef. Live-Fälschungen zeigen allerdings eher Fehler, etwa wenn die Person den Kopf stark dreht. Verlangt jemand im Videoanruf Geld oder Daten, beende das Gespräch und ruf über die bekannte Nummer zurück.
Was ist der Unterschied zwischen einem Deepfake und einem KI-Bild?
Ein Deepfake ahmt meist eine echte Person nach, oft in Videos oder Tonaufnahmen, etwa mit getauschtem Gesicht oder geklonter Stimme. KI-Bilder können dagegen alles zeigen, auch Menschen, die es nicht gibt. Die Grenze ist fließend. Für Standbilder helfen andere Prüfmethoden als für Videos und Anrufe.
Was mache ich, wenn jemand ein Deepfake von mir verbreitet?
Melde den Inhalt der Plattform über deren Meldefunktion und erstatte Anzeige bei der Polizei. Sichere vorher die URL, das Veröffentlichungsdatum und die Uhrzeit des Abrufs. Screenshots sind meist hilfreich, außer bei Darstellungen sexualisierter Gewalt oder von Kindesmissbrauch: Deren Besitz kann schon strafbar sein. Frag im Zweifel bei deiner Polizeidienststelle nach.
Fazit: Deepfakes erkennst du am sichersten am Zusammenhang
Um Deepfakes zu erkennen, lohnt sich der Blick auf Warnsignale in Bild und Ton weiterhin. Viele Fälschungen zeigen noch Fehler an Gesichtsrand, Zähnen, Lippen oder Stimme, vor allem live. Verlassen kannst du dich darauf nicht, auf Erkennungs-Apps ebenso wenig. Was zuverlässig hilft, hat mit Technik nichts zu tun: innehalten, über eine bekannte Nummer zurückrufen, eine persönliche Frage stellen oder das Familien-Codewort abfragen.
Wir glauben, dass sich die Frage auf Dauer umdreht: Statt Fälschungen zu entlarven, belegen echte Aufnahmen ihre Herkunft von Anfang an. Daran arbeiten offene Standards wie C2PA und auch wir mit TrustCamera. Bis das selbstverständlich ist, bleibt der Rückruf dein bester Schutz gegen Deepfakes.
Über den Autor




