- OpenAI と Google は、AI モデルを訓練するために、音声認識ツール Whisper を使って 100 万本以上の YouTube 動画の書き起こしを行った。
- OpenAI による YouTube 動画の利用は、Google のルールに違反する可能性がある。Google は、自社の動画を単独のアプリケーションで使用すること、および自動化された手段によるアクセスを禁じている。
OpenAI と Google は、AI モデルの改良のために YouTube 動画の書き起こしに着手し、クリエイターの著作権を侵害する可能性がある。両テクノロジー大手は Meta とともに、AI モデルの訓練のために可能な限り多くのデータを取得するための近道をとった。
動画クリエイターの著作権侵害
OpenAI は Whisper を使い、100 万時間以上の YouTube 動画を書き起こし、そのテキストをチャットボット ChatGPT に使用される AI システム GPT-4 に取り込んだ。YouTube の所有者である Google も、AI モデル訓練のために動画の書き起こしを行っていた。
両社による動画の書き起こしは、元の作成者の著作権を侵害する可能性がある。AI 訓練にクリエイティブコンテンツを利用する他の事例では、著作権やライセンスに関する訴訟が起きている。
OpenAI による YouTube 動画の使用は、Google のルールにも違反する可能性がある。そのルールでは、自社の動画を「独立した」アプリケーションに使用すること、および「ロボット、ボットネット、スクレイパーなどの自動化手段」によるアクセスを禁じている。
あわせて読みたい:Google とスタンフォード大学の研究者、AI ファクトチェックツールを発表
あわせて読みたい:Google DeepMind の Demis Hassabis CEO、AI 技術で騎士爵を受ける
パブリックデータを使った AI 利用を可能に
New York Times は Google の広報担当者 Matt Bryant から、同社は OpenAI によるそのような利用を認識していなかったと伝えられた。Google の従業員は OpenAI が YouTube コンテンツを違法に使用していることを認識していたが、Google 自身も同様の行為を行っていたため介入しなかった。さらに Google は同紙に対し、AI 訓練のために動画の使用をクリエイターが同意したコンテンツのみを使用していると述べた。2023 年 7 月、Google は AI モデルを改良する目的で、Google Docs や Google Maps のレストラン評価など、オンライン上で公開されているコンテンツを使用できるように利用規約を変更した。

