• AI ツールはテキストを画像に変換できます。Google は、テキストから画像を生成する「Imagen 3」へのアクセスを開放しました。
  • Google は、自然言語の理解が向上し、プロンプトの意図を捉え、より長いプロンプトの細部まで含められると約束しています。

私たちの見解
Google は、自然言語の理解向上、画像内テキストのレンダリング、効率性の向上、ユーザーのパーソナライズされたニーズにより良く応え、より望ましい結果を提供するために、AI 画像生成ツール「Imagen 3」の利用可能範囲を拡大しました。人工知能を「人々に貢献する」ツールとしてさらに位置づけるものです。
— Iydia Ding、BTW ジャーナリスト

何が起きたのか?

Googleは、Imagen 3AI 画像生成ツールの利用可能範囲をひっそりと拡大しました。AI ツールはテキストを画像に変換できます。Google はテキストから画像を生成する「Imagen 3」へのアクセスを開放しました。

報告によると、Imagen 3 は Google の非公開プレビューでリリースされた後、ImageFX を通じて米国の全ユーザーが利用できるようになりました。Google は Imagen 3 を、これまでで最高品質のテキストから画像へのモデルと説明しています。このツールは驚くべき詳細さを生成し、以前のモデルよりも視覚的なアーティファクトが少なく、写実的でリアルな画像を作り出します。

Google は、今年初めに Gemini の画像生成で起きたことを回避しようとしているのかもしれません。ユーザーから、Gemini が実際には存在しなかったであろう異なる民族の人々を描いた歴史的画像を生成したという苦情が寄せられた後、Google は人物の画像生成を完全に停止しました。Elon Elon Musk には明らかにそのような懸念はありません。今週初め、彼のスタートアップ XAI は、ほぼ安全策のない画像生成ツールを含む Grok-2 をリリースしました。

こちらもお読みください:Google、AI 検索機能を新たな国に拡大

こちらもお読みください:カリフォルニア州、Apple と Google ウォレットでデジタル ID を開始

なぜ重要なのか

Google は AI 画像生成ツール「Imagen 3」の利用可能範囲を拡大し、これをこれまでで最高品質のテキストから画像へのモデルと説明し、自然言語をよりよく理解し、画像内でテキストをレンダリングします。Google は今年初めの Gemini 画像生成で起きたことを回避しようとし、AI を「人々にうまく貢献する」ためのさらなるツールにしようとしているのかもしれません。

また、自動化とインテリジェントな手法により、Imagen 3 はユーザーのニーズに応じてさまざまなスタイルや効果をカスタマイズし、パーソナライズされたニーズをより良く満たし、より望ましい結果を提供できます。大量のデータをより効率的に処理できます。従来の手動処理方法と比較して、短時間で大量の画像を迅速かつ正確に処理し、タスクを完了できます。

一方で、高い精度と安定性により効率性を向上させます。他方で、これは科学技術の進歩における画期的な出来事です。人工知能の発展は、社会の進歩を促進し、生活の質を向上させ、地球規模の問題を解決する上で、かけがえのない重要性を持っています。