• Imagen 3 — фотореалистичный генератор изображений, который особенно хорошо работает с подробными и творческими запросами.
  • Google представляет Imagen 3 в рамках стратегии, направленной на сохранение лидерства на конкурентном рынке генерации изображений с помощью ИИ.
  • Интеграция Imagen 3 с Vertex AI, как ожидается, откроет расширенные возможности генерации изображений более широкой аудитории и улучшит приложения в различных отраслях.

Google представилаImagen 3— свою самую качественную на сегодняшний день модель преобразования текста в изображение, доступную в закрытом предварительном доступе. Новая модель обещает беспрецедентную детализацию, улучшенное понимание естественного языка и более качественное отображение текста.

Улучшения и конкурентные преимущества

Douglas Eck, старший директор по исследованиям Google DeepMind, отметил достижения Imagen 3 на конференции разработчиков Google I/O. «Это наша самая мощная модель генерации изображений на сегодняшний день, — заявил Douglas Eck. — Imagen 3 более фотореалистичен, с более богатой детализацией, меньшим количеством визуальных артефактов и искажённых изображений. Он понимает запросы, написанные так, как их формулируют люди: чем подробнее и креативнее запрос, тем лучше. Imagen 3 не забывает учитывать мелкие детали в длинных запросах.

Кроме того, это наша лучшая модель для отображения текста, что долгое время было сложной задачей для моделей генерации изображений».

Читайте также:Google добавляет модель ИИ Gemini Nano в десктопную версию Chrome

Запуск Imagen 3 состоялся через шесть месяцев после выхода Imagen 2 на Vertex AI. Этот шаг — часть стратегии Google по сохранению лидерства в конкурентной среде ИИ, где такие соперники, какDALL-E от OpenAI, Midjourney, Firefly от Adobe, ИИ от Meta и Microsoft Designer, также развивают технологии генерации изображений. Недавний запуск возможностей text-to-live для моделей Google в апреле дополнительно подтверждает стремление компании возглавить рынок генерации изображений с помощью ИИ.

Imagen 3 в настоящее время доступен в закрытом предварительном доступе для ограниченного круга пользователей, а более широкий запуск ожидается по мере того, как разработчики регистрируются в списке ожидания. Интеграция с Vertex AI, как ожидается, откроет расширенные возможности генерации изображений более широкой аудитории и улучшит различные отраслевые приложения.

Читайте также:Google запускает ИИ-чип Trillium, который работает в пять раз быстрее

Реакция на критику

Несмотря на достижения, Google сталкивалась с проблемами в этой сфере. Ранее в этом году компания подверглась критике за неточные сгенерированные ИИ изображения исторических личностей и событий, что привело к обвинениям в том, что ИИ «слишком политкорректен». Google принесла извинения за эти инциденты, а генеральный директор Sundar Pichai в интервью с Emily Chang из Bloomberg подтвердил намерение компании совершенствовать свои модели.