- OpenAI の新しい AI モデル「Sora」は、シンプルなテキスト入力からリアルで想像力豊かな動画制作に革命を起こすことを目指している。
- Sora は左右を混同したり、誰かがクッキーをかじる描写の後に噛み跡を作らなかったりすることがある。
- OpenAI は誤情報、ヘイトコンテンツ、バイアスに関する懸念に対処することを目指しており、誤解を招く情報を検出するツールも開発している。
人工知能のリーディングカンパニーであるOpenAIは、テキスト入力からリアルで想像力豊かな動画制作に革命を起こすと約束する最新 AI モデルSoraを発表した。水曜日のブログ記事で OpenAI は、Sora が最長 60 秒の動画を生成する能力を持ち、複数のキャラクター、特定の動き、詳細な背景を描写できると説明した。
デジタルエンターテインメント業界への AI モデルの影響
市場調査会社ABI ResearchのシニアアナリストReece Hayden氏によれば、Sora を以前のテキスト動画モデルと差別化するのは、その持続時間と精度だ。Hayden 氏は、これらの AI モデルがデジタルエンターテインメント業界に大きな影響を与え、様々なチャネルでパーソナライズされたコンテンツを配信できるようになると考えている。特に、テレビ番組のナラティブを補強する短いシーンの作成の可能性に言及している。
こちらもお読みください:ChatGPT はスマートコントラクトを作成できるが、セキュリティ監査を任せてはいけない
継続的な開発段階
OpenAI は Sora がまだ開発中であることを認めており、空間的な詳細や因果関係に関するモデルの弱点を認めている。例えば、Sora は左右を混同したり、誰かがクッキーをかじる描写の後に噛み跡を作らなかったりすることがある。
OpenAI は安全性に注力しており、モデルの能力をテストするために専門家と緊密に連携する予定だ。同社は誤情報、ヘイトコンテンツ、バイアスに関する懸念に対処することを目指している。OpenAI はまた、誤解を招く情報を検出するツールも開発している。このプロセスの一環として、Sora はまず「レッドチーマー」と呼ばれるサイバーセキュリティの専門家に提供され、潜在的な被害やリスクを評価される。さらに、ビジュアルアーティスト、デザイナー、映画製作者がアクセスし、クリエイティブプロフェッショナルが Sora をどのように活用できるかについてフィードバックを提供する。
こちらもお読みください:OpenAI が ChatGPT の音声機能を公開、CEO ドラマを冗談に、AGI への懸念を示す書簡が浮上
よりパーソナライズされた対話機能
Sora の発表は、OpenAI がバイラルチャットボット ChatGPT を継続的に進歩させているのと同時期に行われた。今週初め、OpenAI はユーザーがすぐに ChatGPT の記憶を制御できるようになり、過去の会話を覚えたり忘れたりすることで、よりパーソナライズされた会話が可能になると発表した。
人工知能分野における OpenAI の継続的な進歩は、同社が生成 AI の限界を押し広げるというコミットメントを示している。Sora が動画制作に革命を起こす可能性と ChatGPT の新たな記憶機能により、OpenAI は AI 業界におけるエキサイティングな発展への道を開いている。

