- Meta Platforms выпустила первые версии своей новейшей большой языковой модели Llama 3 с новыми возможностями в области программирования и обработки команд с изображениями. Модели будут интегрированы в виртуальный помощник Meta AI, который компания называет самым совершенным среди бесплатных аналогов.
- Версии Llama 3, которые планируется выпустить в ближайшие месяцы, также получат «мультимодальность», то есть смогут генерировать и текст, и изображения, — Meta старается догнать лидера рынка генеративного ИИ, компанию OpenAI.
- Модель Llama 2 не способна понимать элементарный контекст; в Llama 3 Meta сокращает эти проблемы, используя «высококачественные данные», чтобы модель могла распознавать нюансы. Спрос на данные для генеративных ИИ-моделей стал одним из главных источников напряжения в развитии этой технологии.
Meta Platforms выпустила первые версии своей новейшей большой языковой модели Llama 3 с новыми возможностями программирования и обработки изображений. Встроенный генератор изображений будет обновлять картинки в реальном времени, пока пользователи вводят запросы, — компания стремится догнать лидера рынка генеративного ИИ OpenAI.
Смотрите поясняющее видео генерального директора Mark Zuckerberg.
Цель — мультимодальная модель ИИ
Версии Llama 3, которые планируется выпустить в ближайшие месяцы, также получат «мультимодальность», то есть смогут генерировать и текст, и изображения, хотя пока модель выдаёт только текст, заявил в интервью директор по продуктам Meta Chris Cox.
Модели будут интегрированы в виртуальный помощникMeta AI, который компания называет самым совершенным среди бесплатных аналогов. Более продвинутые рассуждения, например способность строить длинные многошаговые планы, появятся в последующих версиях.
Читайте также:Meta представляет чип MTAI «всё в одном», в 3 раза быстрее предыдущего
Включение изображений в обучающие данные Llama 3 могло бы улучшить обновление, выпущенное в этом году для умных очков Ray-Ban Meta — партнёрского проекта с производителем очковEssilor Luxoticca. Meta AI сможет распознавать предметы, которые видит владелец, и отвечать на вопросы о них, рассказал Chris Cox.
Кризис данных для обучения ИИ-моделей
Модель Llama 2 не способна понимать элементарный контекст; в Llama 3 Meta сокращает эти проблемы, используя «высококачественные данные», чтобы модель могла распознавать нюансы. Конкурент Google столкнулся с похожими проблемами и недавно приостановил использование своего инструмента генерации изображений Gemini AI после критики за неточные изображения исторических личностей.
Генеральный директор Meta Mark Zuckerberg заявил, что самая крупная версия Llama 3 сейчас обучается на 400 миллиардах параметров и уже набирает 85 баллов в тесте Massive Multitask Language Understanding, ссылаясь на метрики, используемые для оценки мощности и производительности ИИ-моделей.
Читайте также:Американский конгрессмен предлагает законопроект, обязывающий ИИ-компании раскрывать данные для обучения
Ненасытный спрос на данные для генеративных ИИ-моделей стал одним из главных источников напряжения в развитии технологии. Meta не раскрыла подробности об используемых наборах данных, хотя предоставила Llama 3 в семь раз больше данных, чем Llama 2, и применила «синтетические», то есть созданные ИИ, данные для улучшения таких областей, как программирование и рассуждение.

