- Apple は、Apple Intelligence に使用されるモデルを詳述した技術文書を公開し、トレーニングデータは責任あるソースから取得され、プライベートなユーザーデータは一切使用されていないことを強調しました。
- また、Apple はオープンソースコードをライセンスを通じてフィルタリングし、公開データセットを使用して AI モデルをトレーニングしており、モデルが不適切なコンテンツを生成するリスクを低減するための措置も講じていると述べています。
当社の見解
この技術文書は、Apple Intelligence 向けに開発された AI モデルのトレーニングプロセスを説明し、モデルが公開データセットおよびライセンスデータでトレーニングされており、プライベートなユーザーデータは一切使用されていないことを明記して、プライバシー保護と責任ある AI 開発の原則を強調しています。
-Rae Li, BTW 記者
何が起きたのか
Appleは、Apple Intelligence用に開発された AI モデルのトレーニングプロセスを説明する技術文書を公開しました。この文書で Apple は、AI モデルのトレーニングに倫理的に問題のあるアプローチを取っているという主張を否定し、プライベートなユーザーデータではなく、公開データとライセンスデータを使用していることを改めて強調しています。Apple は、事前トレーニングデータセットには出版社からのライセンスデータ、フィルタリングされた公開/オープンソースデータセット、および Web クローラーApplebot によって収集された公開情報が含まれていると述べています。さらに Apple は、ユーザーのプライバシー保護を強調し、データの混合には Apple のプライベートユーザーデータは一切含まれていないことを明らかにしています。
さらに詳しく見ると、Apple は AFM(Apple Foundation Models)のトレーニングデータのソースを明らかにしており、公開 Web データや非公開の出版社からのライセンスデータが含まれています。Apple はまた、GitHub でホストされているオープンソースコードをトレーニングに使用しており、Swift、Python、C、Objective-C、C++、JavaScript、Java、Go などのコードが含まれます。モデルの数学スキルを向上させるため、Apple は Web ページ、数学フォーラム、ブログ、チュートリアル、ワークショップからの数学の質問と回答を特別に含めました。さらに Apple は、人間のフィードバックや合成データを含む追加データを取得し、AFM モデルを微調整して望ましくない動作のリスクを低減しようとしています。Apple は、このモデルがユーザーが Apple デバイスで日常的な活動を行うのを支援するとともに、Apple の基本的価値観と責任ある AI 原則を遵守していると述べています。
関連記事:Apple、ホワイトハウスのイニシアティブで AI 安全性にコミット
なぜ重要なのか
この文書は、Apple がユーザーのプライバシーを保護しながら、どのように AI モデルを開発・トレーニングしているかを示しています。データのプライバシーとセキュリティに対する懸念が高まる中、Apple が AI モデルのトレーニングデータにプライベートなユーザーデータを一切使用していないという明確な声明は、Apple 製品に対する消費者の信頼を強化するのに役立ちます。
さらに、データソースの透明性と責任ある AI 開発原則を重視する Apple の姿勢は、業界にとって肯定的なベンチマークとなり、オープンで許可されたデータをユーザープライバシーを侵害することなく技術革新に活用できることを示しています。Apple が AI モデルのトレーニング詳細を開示したことは、テクノロジーコミュニティや規制当局にとって重要なリファレンスとなります。

