• オランダの著作権保護団体 BREIN が、AI モデルの訓練に使用されていた言語データセットを削除しました。
  • デンマーク権利同盟が、許可なく AI モデルの訓練に使用されていた著作権保護資料を削除しました。

私たちの見解
社会のあらゆるものが規制される必要があるのと同様に、AI モデルの訓練には、正式で合法的、専門的かつ許可されたチャネルからのコンテンツが必要です。BREIN の行動は、AI 開発における著作権法の尊重の重要性と、AI モデル訓練の透明性の必要性を浮き彫りにしています。
–リリー・ヤン、BTW 記者

何が起きたか

オランダの著作権保護団体BREINは、書籍、ニュースサイト、映画やテレビシリーズの字幕などからの無許可コンテンツが含まれていることを発見した後、AI モデルの訓練に使用されていた大規模な言語データセットを削除しました。

このデータセットにはオランダ語の情報が含まれており、許可なく収集されました。BREIN のディレクターであるバスティアーン・ファン・ラムスホルスト氏は、このデータセットが AI 企業によって使用されたかどうか、またどの程度使用されたかは不明であると述べました。

同氏は、欧州連合の AI 法により、AI 企業はモデルの訓練に使用したデータセットを開示することが義務付けられると指摘しました。例えば、デンマーク権利同盟は昨年、「Books3」と呼ばれる大規模データセットの削除を要求しました。同様に、米国では、Microsoftなどの AI 企業が、AI モデルの訓練に著作権保護資料を使用することに関する法的課題に直面しています。

あわせて読みたい:解説:通信規制当局が詐欺電話とスパムにどのように対処しているか

あわせて読みたい:通信詐欺師が若い世代を標的に

なぜ重要か

BREIN の行動と EU の AI 法、そして Microsoft の課題は、AI モデル開発における著作権侵害をめぐる現在進行中の議論を浮き彫りにしています。

BREIN による大規模な言語データセットの削除は、知的財産権を尊重することの重要性を強調しています。AI 企業が、著作権で保護されたソースからのデータをモデルの訓練に使用する際に、適切な許可を得ていることを確認することが極めて重要です。

EU の AI 法の施行が間近に迫っていることや、米国で AI 企業が直面している法的課題は、AI 開発における透明性と説明責任の必要性を強調しています。AI の進歩が続く中、イノベーションと著作権保護のバランスを取ることが不可欠です。