• Gemini— это последняя большая языковая модель Google, которая стремится конкурировать с GPT-4 от OpenAI, предлагая мультисенсорный опыт благодаря способности понимать видео и аудио и взаимодействовать с ними.
  • Google утверждает, что Gemini превосходит GPT-4 в 30 из 32 тестов, при этом её сильной стороной является мультимодальность. Ожидается, что модель будет интегрирована в различные продукты Google, включая поисковую систему, рекламные продукты и браузер Chrome.

Alphabet представил Gemini: ИИ-модель, стремящаяся конкурировать с GPT-4
Alphabet представил Gemini: ИИ-модель, стремящаяся конкурировать с GPT-4


Что произошло?

Генеральный директор Google Сундар Пичаи объявил озапуске Gemini, новой большой языковой модели, которая стремится конкурировать с GPT-4 от OpenAI. Gemini — это универсальная ИИ-модель, которая, как ожидается, окажет значительное влияние на различные продукты Google. Она выпускается в трёх версиях: Gemini Nano — лёгкая модель для устройств Android; Gemini Pro — более мощная версия для сервисов Google AI и Bard; и Gemini Ultra, предназначенная для центров обработки данных и корпоративных приложений. Gemini выделяется способностью понимать видео и аудио и взаимодействовать с ними, предлагая мультисенсорный опыт. Google утверждает, чтоGemini превосходитGPT-4 в 30 из 32 тестов, при этом её сильной стороной является мультимодальность. Ожидается, что модель будет интегрирована в поисковую систему Google, рекламные продукты, браузер Chrome и другие сервисы. С помощью Gemini Google стремится вернуть свои позиции в области ИИ и добиться значительных успехов в генеративном ИИ.

Читайте также:Хороша ли новая функция WhatsApp «исходное качество» для обмена файлами?

Что думают люди?

Запущен Google Gemini AI
Запущен Google Gemini AI

Положительные мнения:

1. Gemini от Google рассматривается как значительный шаг вперёд в области ИИ-технологий, и ожидается, что она окажет серьёзное влияние на все продукты Google.

2. Способность Gemini понимать видео и аудио и взаимодействовать с ними отличает её от GPT-4 от OpenAI, давая преимущество в 30 из 32 тестов.

3. Интеграция Gemini в поисковую систему Google, рекламные продукты и браузер Chrome рассматривается как будущее компании.

4. Мультимодальность Gemini, объединяющая текст, изображения, видео и аудио, считается мощной функцией, которая расширит её возможности.

5. Потенциал Gemini для улучшения задач программирования и мозгового штурма рассматривается как ключевое приложение для этой модели.

Отрицательные мнения:

1. Существуют некоторые опасения по поводу предвзятостей и проблем, которые могут сохраняться у моделей Gemini, несмотря на их достижения.

2. Настоящая проверка возможностей Gemini будет со стороны обычных пользователей, и пока неизвестно, насколько хорошо она будет работать в реальных сценариях.

3. Хотя Google заявляет о приоритете безопасности и ответственности, запуск передовых ИИ-систем сопряжён с внутренними рисками, которые могут иметь непредвиденные проблемы или векторы атак.

4. К выпуску Gemini подходят осторожно, что указывает на возможные неопределённости и потенциальные проблемы, которые предстоит преодолеть.

5. Неясно, сможет ли Gemini догнать ChatGPT от OpenAI, который уже завоевал значительную популярность и признание в индустрии ИИ.

Читайте также:ExpressVPN выпускает новое нативное VPN-приложение для Apple TV

Что дальше?

Изображение статьи
Google запускает ИИ-модель Gemini, конкурента ChatGPT, которая, по словам компании, обучена вести себя как человек.

1. Интеграция в экосистему Google:Ожидается, что Gemini будет бесшовно интегрирована в различные продукты Google, включая поисковую систему, рекламные продукты, браузер Chrome и другие. Эта интеграция улучшит пользовательский опыт и обеспечит более точные и разнообразные ответы.

2. Расширение на несколько языков:Хотя в настоящее время Gemini доступна только на английском языке, Google указала, что планирует расширить языковые возможности, включив в будущем другие языки. Это сделает Gemini более доступной и полезной для более широкой глобальной аудитории.

3. Развитие мультимодальности:Способность Gemini понимать видео, аудио и другие сенсорные входные данные и взаимодействовать с ними, как ожидается, со временем улучшится. Google намерена расширить возможности Gemini за счёт включения дополнительных чувств, таких как действие и осязание, что может иметь значение для робототехники и смежных областей.

4. Повышение производительности и надёжности:Google признаёт, что модели Gemini всё ещё имеют ограничения, включая предвзятости и редкие галлюцинации. Однако компания намерена продолжать исследования и разработки для решения этих проблем и улучшения общей производительности и надёжности Gemini.

Будущее Gemini открывает огромные возможности для Google. По мере того как модель продолжает развиваться и улучшаться, ожидается, что она сыграет решающую роль в формировании будущего продуктов и услуг на основе ИИ и ещё больше укрепит позиции Google в индустрии ИИ.