• ИИ-дипфейк использует продвинутые алгоритмы для создания убедительного поддельного контента, сочетая технологические достижения и потенциальные угрозы. Возникает вопрос: как это работает?
  • Его легальность остаётся неоднозначной: лишь в нескольких штатах действуют специальные нормативные акты.
  • Несмотря на правовой статус, дипфейки несут серьёзные риски, включая шантаж, политические манипуляции и мошенничество, что подчёркивает необходимость комплексного законодательства и повышения осведомлённости.

ИИ-дипфейк — это форма искусственного интеллекта, которая создаёт убедительные поддельные изображения, аудиофайлы и видео. Объединяя «deep learning» (глубокое обучение) и «fake» (подделка), этот термин охватывает как технологию, так и вводящий в заблуждение контент, который она создаёт. Дипфейки подменяют людей в существующем контенте или создают полностью новые сценарии, показывая действия или слова, которых никогда не было. Главная опасность дипфейков — их способность распространять ложную информацию, которая выглядит подлинной. Разберёмся, как работает ИИ-дипфейк.

Читайте также:Какой ИИ-генератор голоса сейчас используют все?

Читайте также:Генеративный ИИ в фармацевтической отрасли

Что такое ИИ-дипфейк?

ИИ-дипфейк — это тип искусственного интеллекта, который используется для создания убедительных подделок: изображений, аудиофайлов и видео. Он сочетает глубокое обучение и подделку, преобразуя существующий исходный контент или создавая полностью новые сценарии. Термин «дипфейк» охватывает и технологию, и создаваемый ею поддельный контент, объединяя концепции глубокого обучения и фальсификации.

Такие дипфейки часто предполагают изменение существующего контента, например замену одного человека другим, или создание совершенно нового контента, где люди совершают действия или произносят слова, которых никогда не было. Дипфейки представляют значительный риск, поскольку могут распространять ложную информацию под видом надёжных источников. Например, в 2022 году появилось дипфейк-видео, на котором президент УкраиныVolodymyr Zelenskyyотдаёт приказ о капитуляции своим войскам.

Высказывались опасения по поводу злоупотребления дипфейками в ходе выборов и в пропаганде, что подчёркивает серьёзность угрозы. При этом важно отметить, что дипфейки используются и в легитимных целях — в видеоиграх, развлечениях и клиентском обслуживании, например в переадресации звонков и работе виртуальных секретарей.

Как работает ИИ-дипфейк?

Технология дипфейков использует два ключевых алгоритма — генератор и дискриминатор, — чтобы создавать и улучшать поддельный контент. Сначала генератор формирует набор данных на основе желаемого результата и создаёт первый цифровой образец. Затем дискриминатор оценивает подлинность этого контента, отличая реалистичность от искусственности. В ходе итеративного процесса генератор улучшает способность создавать убедительный контент, а дискриминатор — точнее выявлять недостатки, которые генератор должен исправить.

Такое сочетание алгоритмов генератора и дискриминатора образуетгенеративно-состязательную сеть (GAN). GAN используют методы глубокого обучения, чтобы находить закономерности в подлинных изображениях и применять их для создания синтетического контента. Например, при создании дипфейк-фотографии GAN изучает множество изображений объекта с разных ракурсов, чтобы уловить детали и полную картину. Аналогично при создании дипфейк-видео GAN анализирует видеоконтент с разных точек зрения, а также поведенческие сигналы, движения и речевые паттерны. Затем эти данные многократно проверяются дискриминатором, чтобы повысить реалистичность итогового результата.

Дипфейк-видео обычно создают одним из двух способов. Во-первых, можно взять оригинальное видео с целевым человеком и изменить контент так, чтобы показать действия или заявления, которых он на самом деле не совершал. Во-вторых, можно заменить лицо целевого человека на видеозапись другого человека — это обычно называют подменой лица.

Существуют разные методы создания дипфейков

Использование исходных видео: дипфейк-автоэнкодер на основе нейросетей изучает исходные видео, чтобы уловить значимые черты цели — мимику и язык тела. Затем он переносит эти особенности в оригинальное видео с помощью системы «энкодер-декодер».
Создание аудиодипфейков: аудиодипфейки используют GAN, который воспроизводит голос человека, строит модель на основе речевых паттернов и с её помощью заставляет голос произносить нужные слова. Этот метод часто применяется при разработке видеоигр.
Синхронизация губ: ещё один распространённый метод — синхронизация губ, при которой технология совмещает аудиозапись с соответствующим видео, создавая иллюзию, что человек в кадре произносит записанные слова. Если сам аудиофайл — дипфейк, это добавляет дополнительный уровень обмана. Этот подход реализуется с помощью рекуррентных нейросетей.

Технологии, необходимые для создания дипфейков

Развитию технологии дипфейков способствуют успехи в нескольких ключевых областях:

GAN-нейросети составляют основу создания дипфейков, используя алгоритмы генератора и дискриминатора.

Свёрточные нейросети (CNN)анализируют закономерности в визуальных данных — это важно для таких задач, как распознавание лиц и отслеживание движений.

Автоэнкодеры, ещё одна разновидность нейросетей, выявляют значимые характеристики цели — например мимику и движения тела — и переносят их в исходное видео.

Алгоритмыобработки естественного языка (NLP)создают аудиодипфейки, анализируя особенности речи и генерируя соответствующий текст.

Высокопроизводительные вычисления обеспечивают значительную вычислительную мощность, необходимую для создания дипфейков.

Согласно докладу Министерства внутренней безопасности США о «растущей угрозе дипфейк-личности», быстро создавать дипфейки позволяют несколько инструментов, в том числе Deep Art Effects, Deepswap, Deep Video Portraits, FaceApp, FaceMagic, MyHeritage, Wav2Lip, Wombo и Zao.

Дипфейки применяют в разных целях

Искусство: создание новой музыки путём ремиксов существующих произведений артиста.

Шантаж и ущерб репутации: помещение жертвы в компрометирующие сценарии, например в незаконные или откровенные действия, для вымогательства или диффамации.

Сервисы ответа на звонки: персонализированные ответы для переадресации звонков и виртуальных секретарей.

Клиентская телефонная поддержка: использование поддельных голосов для рутинных задач, таких как запросы по счетам или обработка претензий.

Развлечения: использование в кино и играх для изменения голосов актёров или создания сатирического и пародийного контента.

Фальшивые доказательства: создание вводящих в заблуждение изображений или аудио для влияния на судебные разбирательства.

Мошенничество: выдача себя за других людей для получения конфиденциальной информации или доступа.

Дезинформация и политические манипуляции: распространение фейковых новостей для влияния на общественное мнение или создания путаницы.

Манипулирование рынком: создание поддельных документов для влияния на курсы акций.

Сообщения: потенциальное будущее использование для воспроизведения стиля переписки пользователей, согласно докладу Министерства внутренней безопасности США о дипфейк-личностях.

Разрешены ли дипфейки законом?

Дипфейки в целом находятся в рамках закона, что создаёт проблемы для правоохранительных органов из-за потенциальных угроз. Они становятся незаконными, когда нарушают существующие законы, например об эксплуатации детей, диффамации или разжигании ненависти.

Лишь в трёх штатах принято специальное законодательство о дипфейках. Техас запрещает дипфейки, влияющие на выборы, Виргиния запрещает распространение дипфейк-порнографии, а Калифорния ограничивает политические дипфейки в преддверии выборов и недобровольную дипфейк-порнографию.

Отсутствие всеобъемлющих законов объясняется широкой неосведомлённостью о технологии дипфейков и её последствиях, из-за чего жертвы остаются практически без защиты.

Какие риски связаны с дипфейками?

Несмотря на правовой статус, дипфейки несут серьёзные риски:

Они позволяют шантажировать и наносить ущерб репутации, помещая жертв в компрометирующие сценарии.

Они облегчают политическую дезинформацию, которую используют государственные субъекты в злонамеренных целях.

Они способствуют вмешательству в выборы, создавая поддельные видео с кандидатами.

Они применяются для манипулирования рынком, влияя на рыночные цены через поддельный контент.

Они питают мошенничество, позволяя выдавать себя за людей для доступа к финансовым и личным данным.