Mistral AI опубликовала Mistral Large 3 на платформе La Plateforme 5 июня 2026 года. Это самая крупная и технически сложная модель компании на сегодняшний день: гибридная плотная архитектура с элементами mixture-of-experts, контекстное окно до 256 000 токенов, многоязычность с официальной поддержкой 24 языков, включая русский, арабский и японский. Часть весов базовой модели открыта под лицензией, допускающей модификацию для некоммерческих и исследовательских целей; полный коммерческий доступ предоставляется через API La Plateforme и партнёрские облака Azure AI и Google Cloud.
Архитектура: плотное ядро и разреженные эксперты
Mistral Large 3 использует схему, при которой базовые слои работают как плотный трансформер, а верхние слои переключаются между специализированными экспертными блоками в зависимости от типа входного токена. По словам команды, это позволяет снизить вычислительную стоимость инференса по сравнению с чисто плотной моделью сопоставимого качества примерно на 35% при том же объёме параметров активации. Точное суммарное число параметров Mistral не раскрывает, однако по косвенным оценкам на основе размера весового файла речь идёт о диапазоне 70–90 млрд активных параметров.
Контекстное окно в 256K токенов обеспечивается применением sliding-window attention с периодическими глобальными слоями, аналогично подходу Mistral в Mixtral 8x22B, но с существенно расширенным базовым размером позиционного кодирования. Компания заявляет о полноценной точности работы на всей длине контекста — без деградации, характерной для моделей, у которых длинный контекст добавлен постфактум через RoPE-масштабирование.
Бенчмарки: конкурентоспособность при более низкой цене API
Mistral публикует сравнительные результаты на нескольких ключевых бенчмарках. На MMLU-Pro Large 3 набирает 73,8% — против 74,2% у Claude Opus 4.7 и 74,5% у GPT-5o, что укладывается в статистическую погрешность теста. На агентном бенчмарке SWE-bench Verified модель показывает 56,1% при single-agent-режиме без scaffold, уступая Opus 4.7 (78,4%) и GPT-5o, но заметно опережая предыдущую версию Mistral Large 2 (41,3%). Многоязычный бенчмарк XTREME фиксирует среднюю точность 81,4% по 40 языкам — один из лучших показателей среди коммерческих моделей для низкоресурсных языков.
Ценовая политика дифференцирует Large 3 от американских конкурентов. Входящий токен стоит $2,5 за 1M, исходящий — $7,5 за 1M. Для сравнения, Claude Opus 4.7 тарифицируется по $15/$75, GPT-5o — по схожим ставкам в верхнем сегменте. Разрыв трёх-пятикратный при сопоставимом качестве на большинстве задач, не требующих предельного рассуждения.
- MMLU-Pro: 73,8% (vs 74,2% Opus 4.7)
- SWE-bench Verified (single agent): 56,1%
- XTREME multilingual: 81,4% (40 языков)
- Цена API (вход/выход): $2,5 / $7,5 за 1M токенов
Разрыв на SWE-bench показателен: Large 3 отстаёт в агентных сценариях с длинным горизонтом, где нужно удерживать состояние задачи через десятки шагов. Mistral это не скрывает и рекомендует модель для извлечения, классификации, многоязычной генерации и ассистентов с коротким циклом, оставляя предельное программирование и сложное рассуждение конкурентам. Для значительной доли корпоративных нагрузок такой профиль достаточен, а трёхкратная экономия на токенах перевешивает отставание в нишевых бенчмарках.
Корпоративный профиль: ЕС-суверенитет и on-prem
Ключевой нарратив релиза — европейский технологический суверенитет. Mistral предлагает data-residency с обработкой данных исключительно на серверах в Европейском союзе, что напрямую адресует требования GDPR и отраслевых регуляторов в финансах и здравоохранении. Эта опция доступна как на La Plateforme (выделенные экземпляры в eu-west зонах), так и через on-prem-развёртывание весов на инфраструктуре заказчика.
On-prem-лицензия включает поддержку квантованных версий модели (INT8, GPTQ-4bit) для инференса на кластерах с GPU класса H100/A100, а также интеграцию с популярными фреймворками: vLLM, TGI и SGLang. По заявлению Mistral, крупный европейский банк уже развернул раннюю версию Large 3 в своём периметре в рамках пилота, полностью изолированного от внешних сетей.
«Мы строим модели для организаций, которые не могут позволить себе отправлять данные за пределы своей юрисдикции — и не должны этого делать», — Гийом Лампль, сооснователь Mistral AI.
Поддержка русского языка — отдельно упомянутый приоритет. Mistral сотрудничает с несколькими европейскими языковыми институтами для формирования обучающего корпуса на восточноевропейских языках. В публичных тестах на задачах перевода и реферирования на русском Large 3 демонстрирует меньше грамматических артефактов, чем Mixtral 8x22B, хотя систематических независимых оценок пока не проводилось.
Команда делает акцент на пропускной способности при длинном контексте. За счёт sliding-window attention стоимость обработки 200K-входа растёт медленнее линейной, что для сценариев с большими документами — юридические базы, техдокументация, архивы переписки — снижает счёт сильнее, чем сама ставка за токен. На внутренних замерах Mistral обработка 200K-контекста обходится примерно вдвое дешевле, чем у плотных моделей сопоставимого качества, хотя независимых публичных тестов пропускной способности пока нет.
Место в конкурентном ландшафте после Series C
Релиз Large 3 следует через несколько недель после закрытия раунда Series C на $1,2 млрд — крупнейшего для европейской ИИ-компании. Финансирование обеспечивает Mistral ресурсы для удержания инженерного таланта в конкуренции с OpenAI и Anthropic, а также для формирования собственной вычислительной инфраструктуры в Европе, независимой от американских гиперскейлеров.
Позиция компании строится на двух дифференцирующих факторах: регуляторно совместимое европейское развёртывание и агрессивное ценообразование по сравнению с аналогами. Ни один из этих факторов не является долгосрочным барьером — американские вендоры могут открыть европейские зоны обработки, а цены на LLM исторически снижались быстро. Поэтому долгосрочная устойчивость стратегии Mistral зависит от того, насколько быстро компания сможет закрепить отношения с европейскими enterprise-клиентами до того, как конкуренты приблизят своё предложение по стоимости и jurisdictional compliance.
Доступность Large 3 через API La Plateforme — немедленная. Fine-tuning API для корпоративных клиентов анонсирован на третий квартал 2026 года.