• Около 3 миллионов фотографий пользователей OkCupid и связанные модели ИИ были удалены.

• Дело связано с передачей данных в 2014 году, которую позже проверила американская FTC.



Что произошло

Clarifai подтвердила удаление около 3 миллионов фотографий пользователей OkCupid, а также моделей распознавания лиц, обученных на этих снимках. Это действие последовало за регуляторной проверкой в рамках делаFederal Trade Commission (FTC), касающегося владельца платформы знакомств Match Group.

Данныеизначально были переданы в 2014 году, когда OkCupid предоставил Clarifai изображения пользователей и связанную с ними информацию из профилей для исследований в области ИИ. Впоследствии этот набор данных использовался для обучения систем распознавания лиц.

Расследование FTC было сосредоточено на том, достаточно ли были проинформированы пользователи о том, что их фотографии из профилей могут быть использованы для обучения ИИ. Регуляторы пришли к выводу, что порядок раскрытия информации и получения согласия не соответствует правилам защиты прав потребителей.

По итогам урегулирования, достигнутого ранее в 2026 году,Clarifaiзаявила, что в апреле подтвердила удаление как набора данных, так и производных моделей. Компания также утверждает, что не передавала данные третьим лицам.

Дело сначала привлекло внимание общественности благодаря сообщениям, а затем было передано на официальную регуляторную проверку, результатом которой стало удаление набора данных из действующих систем.

Читайте также:Big Tech обеспечивает атомную энергию для поддержки роста ИИ

Почему это важно

Это дело не сводится к удалению изображений. Оно вскрывает более глубокую структурную проблему в развитии ИИ: у повторного использования данных редко бывает чёткий срок действия.

Наборы данных, собранные в одну регуляторную эпоху, могут стать источником ответственности в другую. То, что когда-то считалось «исследовательским вкладом», теперь оценивается по более строгим требованиям к информированному согласию и прозрачности.

Дело также демонстрирует растущий разрыв между практиками обучения ИИ и сроками правоприменения в сфере защиты персональных данных. Многие системы ИИ построены на унаследованных наборах данных, которые появились раньше действующих норм управления. Тем не менее регуляторы всё чаще готовы применять современные требования соответствия задним числом.

Более тонкая проблема — фрагментация ответственности. Исходные данные поступали с массовой платформы, а обучение ИИ и разработка моделей происходили в другом месте. Такое разделение затрудняет чёткое распределение ответственности при нарушении норм согласия.

В более широком смысле дело показывает, как регулирование ИИ развивается через правоприменение, а не через проектирование. Вместо того чтобы заранее устанавливать технические ограничения на использование данных, власти всё чаще полагаются на последующие удаления и урегулирования.

Такой подход позволяет исправлять отдельные нарушения, но почти не препятствует аналогичным практикам в других местах отрасли. По мере того как модели ИИ становятся всё более требовательными к данным, существует риск, что обеспечение соответствия станет реактивным, а не структурным.

В конечном счёте дело Clarifai сигнализирует о перемене: исторические наборы данных больше не являются нейтральными активами, а становятся потенциальными регуляторными обязательствами, которые могут быть пересмотрены спустя годы после их использования.

Читайте также:Британские телеком-серверы раскрывают конфиденциальные данные конфигурации