Im Februar 2024 überwies ein Finanzangestellter eines multinationalen Unternehmens in Hongkong umgerechnet rund 25 Millionen US-Dollar auf mehrere Konten. Er war überzeugt, die Anweisung direkt vom CFO seines Unternehmens erhalten zu haben, und zwar in einem Videocall mit mehreren vermeintlichen Kollegen. Alle Gesichter, alle Stimmen waren gefälscht. Es handelte sich um eine vollständig synthetisch erzeugte Konferenz, zusammengesetzt aus öffentlich zugänglichem Video- und Audiomaterial. Der Schaden war real, die Teilnehmer des Meetings existierten nicht.
Wie Deepfake-Angriffe auf Unternehmen funktionieren
Der Hongkong-Fall ist kein Einzelfall, sondern die bisher spektakulärste dokumentierte Variante einer Angriffsmethode, die sich seit 2022 rasant weiterentwickelt. Täter kombinieren zwei bekannte Betrugsformen: den klassischen CEO-Fraud, bei dem sich Kriminelle per E-Mail als Führungskraft ausgeben, und moderne KI-gestützte Bildsynthesetechnologie. Das Ergebnis ist ein gefälschter Videocall, der für den Empfänger kaum von einem echten zu unterscheiden ist.
Die technische Grundlage bildet die sogenannte Deepfake-Technologie, bei der neuronale Netze aus Trainingsbildern realistische Gesichtsanimationen in Echtzeit erzeugen. Für Führungskräfte, die regelmäßig in der Öffentlichkeit auftreten, Interviews geben oder auf Unternehmenswebseiten mit Foto und Video präsent sind, existiert ausreichend Material, um ein überzeugendes digitales Abbild zu konstruieren. Qualitativ hochwertige Ergebnisse sind mit handelsüblicher Hardware und frei verfügbarer Software bereits in wenigen Stunden erreichbar.
Drei dokumentierte Fälle im Überblick
Neben dem Hongkong-Fall gibt es weitere belegte Vorfälle. Ein britisches Energieunternehmen verlor 2019 rund 220.000 Euro, nachdem ein Mitarbeiter eine Sprachnachricht erhielt, die dem CEO täuschend ähnlich klang. Der Anrufer drängte auf eine sofortige Überweisung an einen angeblichen Lieferanten. Sprachanalysen bestätigten später, dass die Stimme synthetisch erzeugt worden war. Im dritten dokumentierten Fall wurde 2023 ein mittelständisches deutsches Produktionsunternehmen über eine gefälschte Videokonferenz zur Freigabe einer Bestellung im sechsstelligen Bereich bewegt. Die Täter hatten sich zuvor wochenlang in die E-Mail-Kommunikation eingelesen, um Kontext, Tonalität und interne Bezeichnungen zu kennen.
Wer sich einen Überblick über strukturierte Fallanalysen verschaffen möchte: Aufbereitete Beispiele zu Deepfake-Betrug zeigen, wie unterschiedlich die Angriffsvektoren im Detail sind und warum pauschale Abwehrstrategien oft nicht greifen.
Warum klassische Sicherheitsprotokolle versagen
Die meisten Unternehmens-Compliance-Systeme sind auf schriftliche Kommunikation ausgerichtet. Phishing-Filter, E-Mail-Authentifizierung und digitale Signaturen greifen bei einem Videocall nicht. Ein Mitarbeiter, der eine scheinbar sichere visuelle Bestätigung durch das erkannte Gesicht seiner Führungskraft erhält, hat aus seiner Perspektive alles richtig gemacht. Genau darauf setzen die Täter.
Erschwerend kommt hinzu, dass in vielen Organisationen Zahlungsfreigaben unter Zeitdruck stattfinden. Liquiditätsengpässe, angebliche Fristen oder vertrauliche Transaktionen werden als Begründung genutzt, warum der normale Genehmigungsweg nicht eingehalten werden kann. Die Kombination aus visueller Täuschung und sozialem Druck macht diese Angriffe besonders wirksam.
Konkrete Schutzmaßnahmen für Unternehmen
Es gibt keine Einzelmaßnahme, die Deepfake-Angriffe vollständig verhindert. Wirkungsvoller Schutz entsteht durch mehrere ineinandergreifende Kontrollen:
- Rückruf über verifizierte Kanäle: Jede Zahlungsanweisung per Videocall muss über eine unabhängig verifizierte Telefonnummer bestätigt werden, nicht über im selben Call angegebene Kontakte.
- Codewort-Systeme: Führungskräfte und Finanzteams vereinbaren ein gemeinsames Codewort, das in sensiblen Situationen abgefragt wird. Es muss nicht in digitaler Form existieren.
- Vier-Augen-Prinzip mit physischer Komponente: Überweisungen ab einem definierten Betrag erfordern die persönliche Zustimmung einer zweiten Person, idealerweise im selben Raum.
- Schulungen mit Echtbeispielen: Mitarbeiter müssen konkrete Videomaterial-Vergleiche sehen, um ein Gespür für typische Artefakte zu entwickeln. Abstrakte Warnungen reichen nicht.
- Technische Detektionslösungen: Spezialisierte Analysewerkzeuge können in Videostreams nach Inkonsistenzen in Belichtung, Lidschlag und Mundmotorik suchen, sind aber kein Allheilmittel.
Rechtliche Einordnung und Meldepflichten
Unternehmen, die Opfer eines solchen Angriffs werden, stehen vor einer doppelten Herausforderung: dem finanziellen Schaden und möglichen regulatorischen Folgen. In Deutschland sind Cybervorfälle mit relevantem Schadensausmaß je nach Branche und Unternehmensstruktur meldepflichtig. Das Bundesamt für Sicherheit in der Informationstechnik empfiehlt ausdrücklich, Vorfälle auch dann zu melden, wenn keine gesetzliche Pflicht besteht, um branchenweite Lagebilder zu verbessern.
Strafrechtlich werden Deepfake-Betrugsfälle in Deutschland in der Regel über bestehende Normen wie Computerbetrug nach Paragraf 263a StGB verfolgt. Eine eigenständige gesetzliche Regelung für den Einsatz synthetischer Medien zu Betrugszwecken fehlt bislang, was die Strafverfolgung erschwert.
Was bleibt als Fazit
Der Hongkong-Fall hat gezeigt, dass selbst erfahrene Finanzfachleute in einer vollständig gefälschten Videositzung keinen Verdacht schöpfen. Technologie allein schützt nicht ausreichend. Entscheidend ist die Kombination aus klaren Prozessen, die unabhängig von der wahrgenommenen Identität des Anweisenden gelten, regelmäßigen Schulungen und einer Unternehmenskultur, in der das Nachfragen ausdrücklich erwünscht ist. Wer Überweisungsfreigaben strukturell so gestaltet, dass kein einzelner Mensch allein entscheiden kann, nimmt Deepfakes einen Großteil ihrer Wirkung. Das kostet keine Millionen, sondern nur Konsequenz.

