Deepfake-Technologie hat es Betrügern erheblich erleichtert, sich als Fachkräfte aus der Geschäftswelt auszugeben. Ein Betrüger kann heute per Kamera an einem Anruf teilnehmen und in Echtzeit überzeugend als eine andere Person auf Fragen antworten.
Dies ist der dritte Kanal für KI-gestützte Identitätsfälschungen – nach E-Mail und Stimme – und der, auf den Unternehmen am wenigsten vorbereitet sind: Ein Gesicht in einem Videoanruf wirkt vollkommen echt und scheint unmöglich zu fälschen.
Wir haben bereits gezeigt, wie KI-Phishing-Kampagnen schneller und einfacher zu starten sind und wie Voice Cloning die Zahl der Vishing-Versuche in die Höhe treibt. In diesem Artikel schauen wir uns an, was passiert, wenn die Identität einer Person mithilfe von Deepfake-Videos missbraucht wird, und wie du verhinderst, dass Teammitglieder auf Deepfake-Betrug hereinfallen.
Was Deepfake-Videobetrug anders macht
E-Mail-Betrug setzt auf schriftliche Details: der richtige Ton, der richtige Kontext und eine plausibel klingende, aber dringende Bitte. Voice Cloning setzt aufs Ohr: eine vertraute Stimme, die etwas so Dringendes sagt, dass ein Moment der Skepsis übergangen wird. Deepfake-Videobetrug geht einen Schritt weiter und gefährdet den einen Verifizierungsinstinkt, den die meisten Menschen nie infrage stellen: jemandes Gesicht zu sehen und die Person sprechen zu hören – in Echtzeit, in einem Anruf, der aussieht wie jede andere Videokonferenz im Kalender.
Mitarbeitende lernen, E-Mails skeptisch zu betrachten und unerwartete Anrufe zu überprüfen. Fast niemand lernt, einen Videocall von Angesicht zu Angesicht infrage zu stellen, denn Video galt stets als so vertrauenswürdig wie ein persönliches Treffen.
Diese neue Form des Betrugs erfordert eine Neubewertung – sowohl dessen, was am Arbeitsplatz als vertrauenswürdig gilt, als auch der Frage, wie leicht Abläufe durch Dringlichkeit ausgehebelt werden können.
So funktionieren Deepfake-Betrugsmaschen in der Praxis
Deepfake-Videobetrug kann verschiedene Formen annehmen. Am einfachsten ist eine vorab aufgezeichnete Deepfake-Videodatei, die in einen laufenden Anruf eingespielt wird – manchmal schaltet der Angreifer die eigene Kamera stumm und behauptet Verbindungsprobleme, um zu erklären, warum die „Führungskraft“ nicht natürlich auf Rückfragen reagiert.
Ausgereiftere Angriffe nutzen Echtzeit-Tools zum Gesichtstausch während eines echten Live-Anrufs, sodass der Angreifer im Moment antworten, nicken und reagieren kann – was deutlich schwerer zu erkennen ist.
Ein drittes Muster ist aufgetaucht, das gezielt Onboarding– und Compliance-Meetings ins Visier nimmt. Eine synthetische Videopersona, die sich als Auditor, als neues Teammitglied oder als HR-Kontakt ausgibt, kann ein ganzes Meeting über sich sitzen lassen, das darauf ausgelegt ist, Systemzugriff, Sicherheitsantworten oder Anmeldedaten zu entlocken – gerade weil diese Meetings auf der Annahme aufbauen, dass ein Videoanruf mit einer echten Person von Grund auf vertrauenswürdig ist.
Ein Deepfake-Betrugsfall aus der Praxis
2024 nahm ein Finanzmitarbeiter im Hongkonger Büro von Arup(neues Fenster), einem in Großbritannien ansässigen Ingenieurbüro, an einem Videoanruf mit Personen teil, die den CFO des Unternehmens und mehrere Kolleginnen und Kollegen zu sein schienen. Jede Person in diesem Anruf war ein KI-generierter Deepfake, erstellt aus öffentlich verfügbarem Material echter Führungskräfte.
In dem Glauben, die Anfrage sei echt, genehmigte der Mitarbeiter fünfzehn Überweisungen mit einem Gesamtwert von rund 25 Millionen USD, bevor der Betrug aufflog – und das auch nur, weil er zufällig bei der echten Zentrale des Unternehmens wegen der „vertraulichen Transaktion“ nachfragte, die er gerade abgeschlossen hatte.
Der Fall Arup bleibt das anschaulichste Beispiel dafür, wie dieser Angriff im großen Stil aussieht, aber es handelt sich nicht um einen Einzelfall. Der Betrugsbericht 2026 von UK Finance(neues Fenster) ergab, dass die Gesamtverluste durch Zahlungsbetrug 2025 auf 1,28 Milliarden GBP stiegen, und wies ausdrücklich darauf hin, dass organisierte kriminelle Gruppen zunehmend Deepfakes, geklonte Stimmen und synthetische Identitäten einsetzen, um sich als vertrauenswürdige Personen auszugeben und Identitätsprüfungen zu umgehen.
Eine separate Branchenstudie von Sumsub(neues Fenster) verzeichnete einen Anstieg der Deepfake-Versuche in Großbritannien um 94 % im Jahresvergleich, und eine Gartner-Umfrage unter Sicherheitsverantwortlichen(neues Fenster) ergab, dass 62 % der Organisationen in den vorangegangen zwölf Monaten irgendeine Form von Deepfake-Angriff erlebt hatten. Jedes Unternehmen, das das noch als Zukunftsproblem behandelt, liegt hinter der Realität zurück, die die Daten bereits zeigen.
Der Fall Arup ist besonders aufschlussreich, wenn es darum geht, worauf man achten muss. Der erste Instinkt des Mitarbeiters war richtig: Er behandelte die ursprüngliche E-Mail als wahrscheinlichen Phishing-Versuch und forderte eigens einen Videoanruf an, um das zu bestätigen – genau der Verifizierungsschritt, den die meisten Sicherheitsschulungen empfehlen würden.
Der Fehler passierte im nächsten Schritt, als der Videoanruf selbst als ausreichender Beweis galt, weil ihm niemand gesagt hatte, dass ein überzeugendes Gesicht auf dem Bildschirm nicht mehr verlässlich ist. In diesem Moment lag das Versagen an unzureichender Schulung im Unternehmen, nicht am Mitarbeiter.
Welche potenziellen Deepfake-Betrugsszenarien gibt es?
Die oben beschriebenen Mechanismen zeigen sich in einigen wiederkehrenden Szenarien, die jeweils an einer anderen Stelle im Unternehmen ansetzen. Dahinter steckt immer derselbe Trick: ein überzeugendes Gesicht und eine überzeugende Stimme in einem Anruf, der völlig normal wirkt. Ziel und Beute können jedoch unterschiedlich sein.
Das Gesicht eines CFO genehmigt eine Überweisung
Ein Deepfake einer leitenden Führungskraft aus dem Finanzbereich erscheint in einem Anruf und weist eine untergeordnete Kraft an, eine dringende, vertrauliche Zahlung auszuführen. Die Anwesenheit eines vertrauten, scheinbar live zugeschalteten Gesichts beseitigt Zweifel, die eine E-Mail allein ausgelöst hätte.
Ein falscher Auditor erlangt Systemanmeldedaten
Eine synthetische Persona, die sich als externer Auditor oder Compliance-Reviewer ausgibt, führt mit Mitarbeitenden aus der IT oder Finanzabteilung ein Videointerview, das als Routineüberprüfung getarnt ist, und stellt Fragen, die gezielt darauf ausgelegt sind, Details zum Systemzugriff, Antworten auf Sicherheitsfragen oder Anmeldeinformationen herauszufinden.
Eine synthetische Person aus der Personalabteilung beim Onboarding eines neuen Mitarbeiters
Ein Deepfake-Kontakt aus der Personalabteilung führt einen Onboarding-Anruf mit einer wirklich neuen Person im Team – oder mit einer bestehenden Mitarbeiterin oder einem bestehenden Mitarbeiter unter dem Vorwand einer aktualisierten Richtlinie – und nutzt die Sitzung, um Details zu internen Systemen, Zugriffsrechten oder Informationen zur Wiederherstellung von Anmeldedaten zu sammeln.
Identitätsdiebstahl eines Vorstandsmitglieds gegenüber der Finanzleitung
Ein Deepfake eines Vorstandsmitglieds oder einer leitenden, nicht geschäftsführenden Person nimmt an einem Anruf mit der Finanzleitung teil, um eine Transaktion zu genehmigen oder vertrauliche Finanzinformationen anzufordern – und stützt sich dabei auf die Autorität einer Rolle, die ein Finanzteam aus kulturellen Gründen nicht infrage zu stellen pflegt.
Warum Deepfake-Betrug schwerer zu entdecken ist
Die meisten Schulungsprogramme gegen Phishing und Vishing funktionieren, indem sie Menschen beibringen, einen Prozess, den jemand überstürzt durchziehen will, künstlich zu verlangsamen: Eine E-Mail lässt sich zur Überprüfung an die IT weiterleiten, ein Anruf lässt sich beenden, um die Telefonnummer zu verifizieren.
Videocalls erfahren diese instinktive Prüfung nicht, denn seit Jahren ist ein Videoanruf der digitale Ersatz, der dem Zusammensein mit jemandem in einem Raum am nächsten kommt. Mitarbeitende werden selten dazu angehalten, dem Gesicht einer Kollegin oder eines Kollegen misstrauisch zu begegnen, denn die kulturelle Annahme hinter Videokonferenzen lautet: Sie sind absolut verlässlich.
Genau diese Annahme nutzt Deepfake-Videobetrug aus. Angreifende Personen müssen die Skepsis eines Mitarbeitenden gegenüber der Anfrage selbst gar nicht überwinden. Sie müssen nur das eine liefern, was Skepsis in der Vergangenheit immer beendet hat: ein vertrautes Gesicht, das in Echtzeit natürlich reagiert.
Das ist eine deutlich höhere Hürde für Mitarbeitende – deshalb müssen die Verifizierungsprotokolle für diesen Kanal prozedural sein und dürfen nicht davon abhängen, dass jemand einfach bemerkt, dass etwas nicht stimmt.
Dazu kommt eine soziale Dynamik, die überwunden werden muss. Eine schriftliche Anfrage infrage zu stellen, fühlt sich wie ganz normale Sorgfalt an. Einen Anruf infrage zu stellen, wirkt nachvollziehbar, denn das Vortäuschen einer Stimme ist seit Jahren ein bekanntes Risiko.
Aber ein Gesicht in einem Videoanruf infrage zu stellen – insbesondere das einer Führungskraft – kann sich eher wie eine Anschuldigung anfühlen, weshalb Mitarbeitende davor zurückschrecken, selbst wenn sich etwas an der Interaktion leicht seltsam anfühlt. Diese sozialen Kosten zu beseitigen und die Frage zur Routine zu machen, die erwartet wird, statt sie als unangenehm zu empfinden, ist ebenso Teil der Deepfake-Prävention und -Abwehr wie jede technische Maßnahme.
Verifizierungsprotokolle, die speziell für Video funktionieren
Code erstellen
Vorab vereinbarte Codewörter oder Gesten, die im Voraus über einen separaten Kanal festgelegt werden, sind eines der wenigen Dinge, die ein Deepfake wirklich nicht erzeugen kann, weil sie in keinem öffentlich verfügbaren Material existieren, mit dem ein Angreifer ein Modell trainieren könnte.
Eine einfache, wechselbare Formel oder ein physisches Signal, das regelmäßig unter Führungskräften und Finanzteams bestätigt wird, gibt den Mitarbeitenden etwas Konkretes, wonach sie fragen können – statt sich auf ein subjektives Gefühl zu verlassen, dass sich ein Anruf falsch anfühlt.
Autorisierungsregeln unverrückbar festlegen
Finanzfreigaben oder die Weitergabe von Anmeldedaten dürfen niemals allein per Videoanruf erfolgen. Das muss eine konkrete Richtlinie sein und keine Ermessensentscheidung, die der Person überlassen bleibt, die gerade im Anruf ist: Jede derartige Anfrage erfordert – ganz gleich, wer scheinbar danach fragt – eine zweite Bestätigung über einen wirklich getrennten Kanal, und zwar über bereits gespeicherte Kontaktdaten statt über Angaben, die während des Anrufs selbst gemacht werden.
Mitarbeitende brauchen eine ausdrückliche, wiederholte Erlaubnis, bei jedem Anruf zu fragen: „Bist du das wirklich?“ – ganz gleich, wer scheinbar auf dem Bildschirm zu sehen ist. Sie sollen sich auch wohl dabei fühlen, über einen anderen Kanal einen Nachweis zu verlangen, dass die Person wirklich die ist, für die sie sich ausgibt.
Genau der Instinkt, der Menschen davon abhält, eine Führungsperson infrage zu stellen, ist das, worauf sich dieser Angriff verlässt. Und dieser Instinkt verschwindet nur, wenn die Führungsebene unmissverständlich klar macht, dass die Frage immer zulässig ist.
Aufzeichnungen aufbewahren
Sensible Videomeetings aufzuzeichnen und zu protokollieren – insbesondere alles, was mit Finanzfreigaben, dem Zugriff auf Anmeldedaten oder dem Onboarding zu tun hat – gibt einem Unternehmen die Möglichkeit, im Nachhinein zu prüfen, falls sich eine Anfrage als Betrug herausstellt. Zudem wirkt das Wissen, dass ein Meeting protokolliert wird, selbst als sanftes Abschreckungsmittel gegen Angreifende, die lieber ohne Spuren operieren.
Videocalls wie eine E-Mail behandeln
Deepfake-Videobetrug ist erfolgreich, weil er genau den Kanal ausnutzt, bei dem Unternehmen ihre Mitarbeitenden nie gelehrt haben, misstrauisch zu sein. E-Mail-Betrug wird durch Phishing-Awareness abgedeckt, Betrug per Stimme durch Rückrufverifizierung und durch die Schulungen, die wir zu Social Engineering im Allgemeinen geschrieben haben.
Wer Deepfake-Videoanrufe durchschauen will, muss dafür keine forensischen Analysten werden, die synthetische Videos Bild für Bild entlarven können. Es erfordert vielmehr, dass ein Unternehmen akzeptiert, dass ein überzeugendes Gesicht und eine überzeugende Stimme für sich genommen nichts mehr beweisen, und Verifizierungsgewohnheiten etabliert, die nicht davon abhängen, dass irgendjemand im Moment misstrauisch wird.
Die Stärkung dieser Kultur – zusammen mit den umfassenderen Praktiken aus unserem Leitfaden zum Aufbau einer starken Sicherheitskultur am Arbeitsplatz – verleiht einem Team denselben Instinkt für Video, den gute Schulungen bereits für E-Mails und Telefonanrufe entwickeln.
Die Anmeldedaten-Verbindung: Begrenzung dessen, was eine fehlgeschlagene Verifizierung erreichen kann
Welche Form ein Deepfake-Videobetrug auch annimmt – CFO-Betrug, ein falscher Prüfer, ein synthetischer Kontakt aus der Personalabteilung –, im Kern zielt er immer auf eines von zwei Dingen ab: eine finanzielle Transaktion oder Anmeldedaten. Das Video ist lediglich das Übertragungsinstrument für eine Anfrage, die im Erfolgsfall entweder direkt Geld bewegt oder dem Angreifer eine Anmeldung verschafft, mit der er nach eigenem Ermessen Schaden anrichten kann.
Genau deshalb ist Anmeldedaten-Hygiene wichtig, selbst wenn der Angriff anfangs nichts mit einem gestohlenen Passwort zu tun hat. Wenn ein Deepfake-Anruf jemanden dazu bringt, Anmeldedaten herauszugeben, begrenzen eindeutige Passwörter und die Multi-Faktor-Authentifizierung, was diese einzelnen Anmeldedaten tatsächlich erreichen können.
Das gleiche Eindämmungsprinzip, das wir im Zusammenhang mit Business Email Compromise behandelt haben, gilt auch hier: Das Ziel besteht nicht darin, jede einzelne Person im Unternehmen gegen einen ausgeklügelten Angriff unbesiegbar zu machen, sondern sicherzustellen, dass der Schaden begrenzt bleibt, wenn eine Verifizierung einmal fehlschlägt.
Ein Passwort-Manager für Unternehmen wie Proton Pass for Business macht diese Eindämmung realistisch umsetzbar: Er nimmt den Druck, vertraute Passwörter kontenübergreifend wiederzuverwenden, und erleichtert es den Mitarbeitenden, sich an deine Passwort-Richtlinien zu halten. In Kombination mit einer sicheren Plattform für Videokonferenzen und einer Unternehmenskultur, in der es als normal und nicht als verdächtig gilt, kurz zu pausieren und etwas zu überprüfen, ist genau diese Kombination es, die den Schaden tatsächlich begrenzt, wenn sich Videocalls selbst nicht mehr vollständig vertrauen lassen.
Reduziere die Gefährdung deines Teams durch Identitätsbetrug mit einem Passwort-Manager für Unternehmen.






