• Французский стартап Mistral удивляет отрасль запуском Mixtral 8x7B через торрент-ссылку.
  • Пользователи хвалят модель: она превосходит GPT-3.5 от OpenAI и другие аналоги.
  • Приверженность Mistral открытому коду выделяет её на фоне культурной войны в ИИ.

Неожиданным ходом, привлёкшим внимание технологического сообщества, французский ИИ-стартапMistralвыпустил свою новейшую большую языковую модель (LLM) в открытый доступ без предварительного анонса, опубликовав её через скромную торрент-ссылку на популярном форуме X. Этот нетривиальный подход резко контрастирует с традиционной практикой представления передовых алгоритмов через пресс-туры и тщательно подготовленные публикации в блогах.

Нестандартный запуск Mistral вызвал ажиотаж в сети

Mistral, недавно закрывшая впечатляющий раунд финансирования серии A на 415 миллионов долларов, теперь оценивается примерно в 2 миллиарда долларов. Новейшая разработка стартапа —Mixtral-8x7B— быстро привлекла внимание впечатляющей производительностью: пользователи утверждают, что она легко превосходит возможности GPT-3.5 от OpenAI, одной из ведущих LLM в этой области.

Mixtral-8x7B
Mixtral 8x7B

Решение выпустить модель через торрент-ссылку встретили с долей иронии и восхищения, особенно на форуме X, где пользователи оценили подчёркнуто небрежный, хакерский стиль Mistral. Один из комментаторов обратил внимание на отсутствие привычных промо-элементов: «Без блога, без шумихи, без описания — просто торрент с файлами модели... Mistral понимает, что её основная аудитория — инженеры, и знает их культурные эрогенные зоны».

Mistral нарушает молчание и раскрывает детали о Mixtral-8x7B

Хотя первоначальный запуск оставил пользователей гадать о мотивах Mistral, компания в понедельник опубликовала пост в блоге с подробностями о Mixtral-8x7B. Согласно опубликованным бенчмаркам, алгоритм Mistral превосходит некоторых американских конкурентов, включая семейство Llama 2 от Meta и знаменитый GPT-3.5 от OpenAI.

По мере появления на рынке всё большего числа ИИ-продуктов пользователи будут их сравнивать. Mixtral-8x7B-32kseqlen, сокращённо Mixtral.Lulu ChengMeservey считает, что название звучит как что-то в духе Elon Musk: это просто описание — смесь экспертов, 8 моделей, 7 миллиардов параметров, размер контекста 32k.

Без блога, без шумихи, без описания — просто торрент с файлами модели. Простой кусок мяса.

Если коротко: Mistral понимает, что её основная аудитория — инженеры, и знает их культурные эрогенные зоны. По сравнению с запуском Google скорость Mistral, ориентация на суть, лаконичный минимализм и «mic drop» без фанфар выигрывают этот раунд.

Lulu Cheng Meservey, CCO/EVP в Activision Blizzard; личный аккаунт. Ранее работала в Substack, соосновательница TrailRunner.

Онлайн-сообщество вторит похвалам новому алгоритму Mistral

Онлайн-сообщество вторит этим оценкам, хваля скорость и эффективность нового алгоритма Mistral. Форум X заполонили мемы и комплименты, подчёркивающие очевидный успех Mixtral-8x7B. Интересная деталь стратегии Mistral — открытый исходный код модели, что резко контрастирует с закрытым подходом OpenAI, который критикуют в отрасли.

Приверженность Mistral открытому коду всего своего программного обеспечения для ИИ согласуется с более широким видением компании, как заявил генеральный директор Arthur Mensch. Mensch подчеркнул приверженность Mistral «открытому, ответственному и децентрализованному подходу к технологиям», что прочно позиционирует компанию внутри растущей культурной войны в ИИ-индустрии.

По мере того как Mistral ломает традиционные нормы запуска ИИ-моделей, успех Mixtral-8x7B и её открытый исходный код бросают вызов устоявшимся игрокам. Пока неясно, станет ли нестандартный подход Mistral трендом или останется единичным случаем, но стремительный взлёт компании и её смелые стратегии, несомненно, дали повод для разговоров в технологическом мире.