- Stability AI は、ロイヤリティフリーの録音データで訓練されたサウンドと音楽生成用の AI モデル「Stable Audio Open」を公開しました。
- このモデルはドラムビート、楽器のリフ、環境音を生成できますが、完全な曲、メロディ、ボーカルは生成できません。
- Stable Audio Open は商用利用を目的としておらず、文化の多様性に欠ける訓練データによってバイアスが存在します。
BTW Media の見解
Stable Audio Open のリリースは、親会社の業界内での地位を強化し、ユーザーに関連サービスを提供する可能性がある一方、トレーニングデータの使用は著作権者の権利を侵害し、一連の法的問題を引き起こす恐れがあります。
–Audrey Huang, BTW 記者
Stability AI はAI 駆動のサウンドジェネレーター「Stable Audio Open」を発表しました。これはテキストプロンプトを使用して最大 47 秒のオーディオクリップを作成します。ロイヤリティフリーのデータのみで訓練されており、さまざまな音声要素を生成できますが、完全な曲やボーカルの作成には制限があります。このモデルの使用は非商用目的に限定されており、訓練データに起因するバイアスがあります。このリリースは、AI と著作権をめぐる論争に対処しつつ、Stability AI のプレミアムサービスを宣伝することを目的としています。
Stability AI のサウンドジェネレーター
画像生成 AI「Stable Diffusion」で知られる Stability AI は、Stable Audio Openをリリースしました。この AI モデルはテキストの説明から音と音楽を生成し、48 万 6 千以上の無料の音楽ライブラリからのサンプルを使用しています。ビデオや映画制作に役立つさまざまな音声要素を作成できますが、完全な曲やボーカルの生成は制限されています。
あわせて読む:次なる音楽革命:AI サウンドエフェクトジェネレーター
あわせて読む:LA フェスティバルで注目される映画における AI の台頭
Stable Audio Open の限界とバイアス
Stable Audio Open は完全な曲、メロディ、ボーカルを作成できません。さらに、訓練データに由来するバイアスがあり、多様な文化の表現が不足していることが示されています。また、非商用利用に限定されており、AI の能力と倫理的・法的配慮のバランスを取るという課題が浮き彫りになっています。
著作権の懸念への対処
Stable Audio Open のリリースは、AI と著作権に関する懸念が高まる中で行われました。Stability AI が訓練にロイヤリティフリーのデータのみを使用するという決定は、これらの問題を解決することを目的としており、一部では著作権侵害と見なされる慣行とは一線を画しています。このステップは、同社のプレミアムサービスを宣伝し、音楽分野における Stability AI の地位を強化することにもつながります。

