• Voice Engineは、OpenAI が開発した音声合成プラットフォームで、合成音声の作成を可能にします。
  • AI 音声技術の非倫理的な使用は、スパムや懸念を引き起こす可能性があります。

音声クローン作成モデル「Voice Engine」は 2022 年後半から開発されており、ある人物の声を 15 秒間録音したものから合成音声を生成することができます。しかし、生成 AI の発展に伴い、倫理的な懸念も高まっています。

OpenAI が Voice Engine を発表

OpenAI は、短い音声サンプルから合成音声を作成できる音声合成プラットフォーム「Voice Engine」を公開しました。

あわせて読みたい:OpenAI の音声クローンツール、わずか 15 秒のサンプルで声を模倣

この革新的な技術は、複数の言語でテキストの指示を読み上げる AI 生成音声を生成でき、さまざまな分野での応用が期待されています。

Voice Engine への限定的なアクセスは、Age of Learning、HeyGen、Dimagi、Livox、Lifespan などの特定の企業に付与されています。

OpenAI の倫理的アプローチ

先月、ジョー・バイデン大統領の AI クローン音声を使った自動電話を受けた人々を受けて、連邦通信委員会(FCC)は自動電話を禁止しました。

こうした懸念に対応するため、OpenAI は AI 音声技術に関する倫理ガイドラインを導入しています。パートナー企業は、同意のないなりすましを禁止する利用ポリシーを遵守し、話し手の明示的な同意を得て、聞き手に音声が AI 生成であることを通知する必要があります。

また OpenAI は、音声の出所を追跡するための透かし技術を実装し、その使用状況を積極的に監視しています。この取り組みは、音声認証の段階的な廃止、個人の声を保護するポリシーの実施、ディープフェイクに関する教育の強化、AI 生成コンテンツの追跡システムの開発など、AI のリスクを軽減するための幅広い取り組みの一環です。