
41
Бро, тема жёсткая – CEO Fraud эволюционировал из письма “срочно переведи деньги, я в самолёте” в видеозвонок, где твой финансовый директор лично, живьём, глазами и голосом просит перевести миллионы. Только это не он. Разберём механику атаки, реальные кейсы на десятки миллионов долларов, и что реально работает в защите.
Кейс, который изменил индустрию
В феврале 2024 года сотрудник финансового отдела гонконгского филиала мультинациональной компании перевёл мошенникам 25 млн долларов (200 млн гонконгских долларов) после видеоконференции, где “участвовали” CFO компании и несколько других коллег. Проблема: абсолютно все участники звонка, кроме самой жертвы, были deepfake-реконструкциями реальных людей. Сотрудник сначала засомневался, получив письмо о “секретной транзакции”, но видеозвонок с знакомыми лицами и голосами снял все подозрения – он перевёл деньги пятью траншами.
Это не единичный случай. По данным BrightSide AI, суммарные подтверждённые убытки от deepfake-мошенничества достигли около 3.7 млрд долларов, из которых ~89% зафиксировано в 2025 и первой половине 2026 года. Корпоративная импersonация executive-уровня – это порядка 25% от всех убытков этой категории, а атаки на компании выросли на 3000% с 2023 года.
Механика атаки: от голоса до полноценного видео
Сбор материала. Атакующему достаточно короткого публичного аудиофрагмента цели – выступление на конференции, интервью, запись с YouTube – чтобы клонировать голос. Для видео используют публичные фото, записи совещаний, вебинары.
Voice cloning как входная точка. Voice-клонинг фрод вырос на 680% за последний год, средний убыток на инцидент превышает 500 тысяч долларов, а для крупных компаний – 680 тысяч долларов на атаку. Часто это первый шаг: звонок “от CEO” с голосовым deepfake, который потом подкрепляется видео для окончательного убеждения жертвы.
Синтетическое видео в реальном времени. Технически это либо pre-recorded ролик с заранее прописанным сценарием под конкретный запрос (перевод, смена реквизитов), либо live face-swap через виртуальную камеру во время реального видеозвонка – именно так были подделаны сразу несколько участников гонконгского звонка одновременно. FBI IC3 зафиксировало 21 442 инцидента AI-powered BEC в 2026 году, и CEO fraud на базе deepfake сейчас затрагивает по оценкам не менее 400 компаний в день.
Психологическое давление. Сценарий почти всегда строится на срочности, конфиденциальности (“это закрытая M&A-сделка, никому не говори”) и авторитете – жертва физически видит и слышит начальника, что снимает базовый уровень скепсиса, который сработал бы при обычном письме.
Артефакты, которые пока выдают deepfake
Технический детект строится на поиске рассинхронизации между слоями рендеринга: неестественное мигание (или его полное отсутствие), несовпадение движения губ со звуком, артефакты на границах лица при повороте головы, несоответствие освещения лица и фона, а также отсутствие естественных бликов в глазах. Проблема в том, что при сжатии звука по телефонному каналу или в условиях плохого видеосвязи многие из этих артефактов пропадают – современные генеративные модели уже закрыли большинство детектируемых пробелов для коротких фрагментов речи.
Именно поэтому эксперты сходятся в одном: технический детект – это вторичный слой alerting, а не надёжный gate для принятия решений о переводе денег.
Защита: что реально останавливает атаку