Мошенники научились подделывать голос близких: как распознать дипфейк и защитить деньги
Как мошенники клонируют голос родственников и руководителей с помощью нейросетей. Признаки голосового дипфейка, правила защиты и порядок действий после перевода денег
Опубликовано15.07.2026 · 10:46
Чтение21 мин.
Просмотры 1 560
Р
АвторРедакция 1000news.ruРедакция
Звонок с голосом родственника, руководителя или коллеги больше нельзя считать подтверждением личности. Генеративные модели научились воспроизводить тембр, интонацию, паузы, дыхание и характерные особенности речи человека по фрагментам, найденным в соцсетях, мессенджерах или записях онлайн-встреч. Мошеннику остается встроить синтезированный голос в знакомый сценарий: сообщить о чрезвычайной ситуации, потребовать срочно перевести деньги и не дать жертве времени на проверку.
Главное изменение 2026 года заключается не только в качестве искусственного голоса. Технология стала дешевой, быстрой и доступной человеку без профессиональных навыков. Вместо студии и длительной обработки используются готовые приложения и открытые модели, которые работают на обычном компьютере или смартфоне. Одновременно мошенники собирают сведения о семье, работе и привычках жертвы, поэтому поддельный звонок строится не из случайных фраз, а из реального контекста.
Такая схема опаснее обычного телефонного мошенничества. Когда человек слышит голос близкого, эмоциональная реакция возникает раньше проверки фактов. Страх за родственника или давление со стороны якобы руководителя сокращают время принятия решения до нескольких минут. За этот период жертва успевает перевести деньги, раскрыть код из СМС или предоставить доступ к аккаунту.
Почему мошенники начали массово подделывать голоса
Голосовые дипфейки существовали и раньше, но долго оставались дорогим и технически сложным инструментом. Для убедительного результата требовались качественные записи, мощное оборудование, специалисты по обработке звука и ручная настройка модели. Такая себестоимость ограничивала применение технологии единичными атаками на компании или обеспеченных людей.
Сейчас порог входа снизился. Голос человека можно получить из видеоролика, подкаста, публичного выступления, голосового сообщения или записи рабочей конференции. После обучения модель способна произносить новые фразы, которых человек никогда не говорил. Генерация может происходить заранее либо непосредственно во время телефонного разговора.
Одновременно изменилось поведение пользователей. Рабочие поручения передаются через мессенджеры, руководители отправляют голосовые сообщения, а родственники нередко общаются только по телефону. Голос фактически стал неформальным идентификатором личности, хотя он не содержит надежной защиты от копирования.
Сайфулин Илья Сергеевич, руководитель правового сектора в IT-производстве, кандидат политических наук, обращает внимание на сочетание технологической доступности и психологического давления:
Массовость голосовых дипфейков объясняется экономикой атаки. Мошеннику больше не нужно лично имитировать чужую манеру речи или долго убеждать собеседника. Один голосовой клон можно использовать в серии звонков родственникам, коллегам и деловым партнерам владельца голоса. Информацию для сценария злоумышленники собирают из открытых профилей, утечек данных, корпоративных сайтов и переписки в скомпрометированных аккаунтах.
Поддельный голос особенно эффективен в коротких разговорах. Мошенник не пытается долго поддерживать беседу. Он сообщает о ДТП, задержании, проблеме с банковским счетом или срочном поручении руководства, после чего требует немедленного действия. Короткий сценарий снижает вероятность того, что синтез речи выдаст себя на сложном вопросе.
Подробно механизм такой атаки объясняет Даниил Королев, ассистент кафедры «Информационная безопасность» МТУСИ, разработчик НОЦ ИБ «Лаборатории Касперского»:
Насколько точно нейросеть может скопировать голос человека
Качество подделки зависит от исходной записи, продолжительности разговора и сложности фраз. Для короткого сообщения мошеннику может хватить нескольких секунд или десятков секунд чистой речи. Чем меньше посторонних звуков, музыки и голосов других людей, тем точнее модель воспроизводит тембр и интонацию.
Современные системы копируют не только высоту и окраску голоса. Они воспроизводят скорость речи, акцент, хрипотцу, характерные паузы, междометия и эмоциональное состояние. Дополнительно в звонок можно встроить шум улицы, аэропорта, больницы или торгового центра, чтобы сценарий соответствовал предполагаемому месту нахождения человека.
Однако убедительность подделки снижается во время длинного диалога. Синтезированный голос может ошибаться в ударениях, делать неестественные паузы, повторять конструкции или с задержкой реагировать на неожиданные вопросы. Поэтому злоумышленники ограничивают разговор несколькими фразами и постоянно подталкивают жертву к действию.
Эксперты ББР Банка указывают, что для проверки нужно анализировать не только звук, но и саму логику разговора:
Способность модели воспроизвести голос за несколько секунд не означает, что любая подделка будет безупречной. Короткий и чистый образец позволяет передать тембр, но для копирования индивидуальной манеры речи требуется больше данных. Именно поэтому злоумышленники изучают голосовые сообщения, видео и публичные выступления одного человека из нескольких источников.
Ориентироваться только на металлическое звучание или роботизированную интонацию опасно. Качественный дипфейк может не содержать очевидных дефектов, а плохая телефонная связь, шум или сжатие аудио маскируют оставшиеся артефакты. Надежнее проверять не голос, а личность и саму просьбу.
Как распознать голосовой дипфейк во время звонка
Первый признак атаки — требование действовать немедленно. Мошенник сообщает, что попал в ДТП, находится в полиции, потерял телефон, не может войти в банковское приложение или должен срочно оплатить лечение. В корпоративной схеме речь идет о конфиденциальной сделке, проверке службы безопасности, внезапном платеже или поручении руководителя.
Срочность нужна не для правдоподобия, а для блокировки проверки. Чем меньше времени остается у жертвы, тем ниже вероятность, что она перезвонит родственнику, свяжется с коллегой или заметит несоответствие в деталях. По той же причине мошенник запрещает обсуждать ситуацию с другими людьми и просит сохранить разговор в тайне.
Второй признак — нетипичный способ передачи денег. Родственник может якобы попросить перевести средства незнакомому человеку, курьеру, юристу или сотруднику больницы. Лжеруководитель направляет реквизиты физического лица или новый счет, который раньше не использовался компанией. Такие изменения требуют проверки независимо от того, насколько узнаваемо звучит голос.
Третий признак — уклонение от личных вопросов. Мошенник способен собрать из соцсетей имена родственников, место работы и общие сведения, но ему сложнее ответить на вопрос о недавнем семейном событии, внутренней шутке или детали, которая не публиковалась в интернете.
Тим Зинин, сооснователь компании «Зинин, Штурбин и партнёры», внедряющий ИИ в бизнес и ежедневно работающий с генеративными моделями, объясняет, почему решающим маркером становится не качество голоса, а конструкция разговора:
Нельзя рассчитывать, что видеозвонок автоматически решит проблему. Генеративные системы умеют подменять лицо, мимику и движение губ, а низкое качество мобильной связи скрывает дефекты изображения. Важнее проверить человека через независимый канал: завершить разговор и позвонить по сохраненному номеру, написать в старую переписку или связаться с другим родственником.
В компаниях аналогом такой проверки должна стать процедура подтверждения платежа. Ни голосовое сообщение, ни звонок руководителя, ни видеосвязь не должны отменять установленный порядок согласования операции. Чем крупнее или необычнее платеж, тем больше независимых подтверждений необходимо получить.
Как защититься от звонков голосом родственника или начальника
Самая надежная защита — исключить голос из списка достаточных доказательств личности. Узнаваемая интонация подтверждает только качество синтеза, но не доказывает, что звонит реальный человек. Любая просьба о деньгах, кодах доступа или конфиденциальных данных должна проверяться отдельно.
Для семьи полезно заранее установить кодовое слово. Оно не должно совпадать с кличкой животного, датой рождения, местом отдыха или другой информацией, которую можно найти в открытом профиле. Код необходимо использовать только в экстренных ситуациях и менять после любого подозрительного звонка.
Второе правило — перезванивать самостоятельно. Звонок нужно завершить, открыть сохраненный контакт и набрать номер вручную. Нельзя перезванивать через кнопку в журнале вызовов, если неизвестно, кому принадлежит входящий номер. Дополнительно можно написать человеку в привычный мессенджер или связаться с родственником, который находится рядом с ним.
Третье правило — не передавать коды из СМС, данные карты, пароли и резервные коды двухфакторной аутентификации. Реальному родственнику, сотруднику банка или руководителю эти сведения не нужны. Код подтверждает действие в аккаунте пользователя, поэтому его передача фактически дает мошеннику возможность завершить операцию.
Четвертое правило — сократить количество качественных образцов голоса в открытом доступе. Полностью отказаться от видео и голосовых сообщений невозможно, но публикация длинных записей облегчает обучение модели. Особенно осторожно следует обращаться с записями совещаний, публичных выступлений руководителей и голосовыми сообщениями из закрытых рабочих чатов.
На связь между открытыми данными, социальной инженерией и качеством подделки указывает Андрей Головин, ведущий аналитик «СёрчИнформ»:
Для пожилых родственников правила лучше закрепить письменно и несколько раз разобрать на конкретном примере. Человеку нужно заранее объяснить, что настоящий родственник не обидится на проверочный звонок, а экстренная ситуация не отменяет возможность потратить одну минуту на подтверждение информации.
Корпоративная защита требует более жесткой процедуры. Сотрудникам необходимо запретить менять реквизиты, раскрывать доступы или проводить необычные платежи только на основании звонка или голосового сообщения. Подтверждение должно проходить через корпоративную систему, письменную заявку и второго уполномоченного сотрудника.
Что делать, если деньги уже переведены мошенникам
После перевода денег счет идет не на дни, а на минуты. Первое действие — позвонить в банк по официальному номеру из приложения или с обратной стороны карты. Нужно сообщить, что операция была совершена под воздействием мошенников, попросить приостановить перевод, заблокировать карту и проверить другие операции по счету.
Даже если перевод уже исполнен, обращение необходимо зарегистрировать. Деньги могут проходить через несколько счетов, а оперативная фиксация инцидента повышает вероятность блокировки дальнейшего движения средств. Одновременно следует обратиться в банк получателя, если его реквизиты известны.
Второе действие — сохранить доказательства. Нельзя удалять переписку, журнал вызовов, голосовые сообщения и реквизиты перевода. Желательно зафиксировать номер телефона, имя аккаунта, ссылку на профиль, точное время звонка, сумму операции и содержание требований. Эти данные понадобятся банку, полиции и специалистам, которые будут анализировать цифровой след.
Третье действие — проверить аккаунты. Если мошенник располагал личной информацией, голосовыми сообщениями или контактами родственников, источником могла быть не только открытая публикация, но и взлом мессенджера либо электронной почты. Пароли необходимо менять с устройства, которое не использовалось во время инцидента. Для каждого сервиса нужен отдельный пароль длиной не менее 12 символов и двухфакторная аутентификация.
Четвертое действие — предупредить родственников, коллег и деловых партнеров. Если голос уже скопирован, злоумышленники могут продолжить цепочку и звонить другим людям от имени владельца. Предупреждение снижает эффективность последующих атак и позволяет быстрее выявить скомпрометированный аккаунт.
Пятое действие — обратиться в полицию и приложить к заявлению все собранные материалы. Само заявление не гарантирует возврат денег, однако создает официальную фиксацию мошенничества и позволяет связать эпизод с другими звонками, номерами и банковскими счетами.
Голосовые дипфейки меняют базовое правило цифровой безопасности. Раньше знакомый голос снижал подозрения, теперь он должен запускать дополнительную проверку. Чем точнее нейросети копируют человека, тем меньше смысла искать дефекты в интонации и тем важнее анализировать просьбу, реквизиты, срочность и способ связи.
Рабочая защита строится не на способности распознать синтетический звук, а на процедуре: завершить входящий звонок, связаться с человеком по сохраненному номеру, задать личный вопрос, проверить просьбу вторым каналом и не проводить финансовые операции под давлением. Такая последовательность занимает несколько минут, но разрывает сценарий, на котором держится вся атака.