- Apple опубликовала технический документ с подробным описанием моделей, используемых для Apple Intelligence, подчеркнув, что данные для обучения поступают из ответственных источников и что никакие личные данные пользователей не используются.
- В документе также говорится, что Apple фильтрует открытый код по лицензиям и использует публичные наборы данных для обучения своих моделей ИИ, а также принимает меры для снижения риска того, что модели будут генерировать нежелательный контент.
НАШЕ МНЕНИЕ
Технический документ описывает процесс обучения моделей ИИ, разработанных для Apple Intelligence, и уточняет, что модели обучаются на публичных и лицензированных наборах данных, что гарантирует отсутствие использования личных данных пользователей. Тем самым подчёркиваются принципы конфиденциальности и ответственной разработки ИИ.
— Рэй Ли, журналист BTW
Что произошло
Appleопубликовала технический документ, описывающий процесс обучения моделей ИИ, разработанных дляApple Intelligence. В этом документе Apple опровергает утверждения о том, что она использует этически спорный подход к обучению своих моделей ИИ, и повторяет, что не использует личные данные пользователей, а полагается на публичные и лицензированные данные. Apple сообщает, что её предобучающие наборы данных включают лицензированные материалы издателей, отфильтрованные публичные или открытые наборы данных, а также публичную информацию, собранную её веб-краулером Applebot. Кроме того, Apple подчёркивает защиту конфиденциальности пользователей, уточняя, что в смеси данных нет личных данных пользователей Apple.
Более подробно Apple раскрывает источники данных для обучения своих моделей AFM (Apple Foundation Models), включая публичные веб-данные и лицензированные материалы неназванных издателей. Apple также использовала для обучения открытый код, размещённый на GitHub, включая код на Swift, Python, C, Objective-C, C++, JavaScript, Java и Go. Чтобы улучшить математические способности модели, Apple специально включила математические вопросы и ответы с веб-страниц, математических форумов, блогов, учебных пособий и семинаров.
Кроме того, Apple получила дополнительные данные, включая отзывы людей и синтетические данные, для дообучения модели AFM и снижения риска нежелательного поведения. Apple отмечает, что модель создана, чтобы помогать пользователям выполнять повседневные задачи на своих устройствах Apple, соблюдая при этом ключевые ценности и принципы ответственной разработки ИИ компании Apple.
Читайте также:Сотрудники розничных магазинов Apple добились контракта после профсоюзной кампании
Читайте также:Apple берёт на себя обязательства по безопасности ИИ в рамках инициативы Белого дома
Почему это важно
Этот документ показывает, как Apple разрабатывает и обучает свои модели ИИ, защищая при этом конфиденциальность пользователей. В условиях растущей обеспокоенности по поводу конфиденциальности и безопасности данных чёткое заявление Apple о том, что данные для обучения её моделей ИИ не содержат личных данных пользователей, способствует укреплению доверия потребителей к продуктам Apple.
Кроме того, акцент Apple на прозрачности источников данных и принципах ответственной разработки ИИ служит положительным ориентиром для отрасли, показывая, как открытые и разрешённые данные могут использоваться для технологических инноваций без ущерба для конфиденциальности пользователей. Раскрытие Apple деталей обучения своих моделей ИИ даёт важный ориентир для технологического сообщества и регуляторов.

