Модели
Z.ai выложила веса GLM-5.2 под лицензией MIT 17 июня 2026 года. MoE-модель на 744 млрд параметров (40 млрд активных) набирает 51 балл в Artificial Analysis Intelligence Index v4.1 — лучший результат среди открытых весов.
17 июня
4 мин
Модели
Google DeepMind 10 июня 2026 года открыла веса DiffusionGemma — первой открытой LLM на текстовой диффузии. Модель генерирует блок из 256 токенов параллельно за один проход и работает до 4 раз быстрее авторегрессии, выдавая 1000+ токенов в секунду на одной H100.
10 июня
3 мин
Модели
Mistral AI представила Mistral Large 3 — флагман с гибридной архитектурой и контекстом до 256K токенов, первый крупный релиз после раунда Series C на $1,2 млрд. Модель ориентирована на корпоративный сегмент: data-residency в ЕС и on-prem-развёртывание на инфраструктуре заказчика.
6 июня
5 мин
Модели
1 июня MiniMax представила M3 — модель с контекстом на миллион токенов, работой с видео и управлением экраном. Заявленные баллы выше GPT-5.5, но независимых проверок пока нет. Веса обещаны позже.
3 июня
3 мин
Модели
Команда Alibaba опубликовала семейство Qwen3 под лицензией Apache 2.0. Линейка включает плотные модели и MoE-варианты с упором на дешёвый инференс и длинный контекст. Релиз усиливает позиции открытых весов в сегменте, где задавали тон закрытые API.
30 мая
3 мин
Модели
Дистилляция и пересборка тренировочного корпуса дали результат, опередивший Mistral 7B на восьми из десяти задач MMLU-Pro. Что стоит за этим скачком и почему это важно для команд, работающих на edge-устройствах.
20 мая
3 мин
Модели
Компания выложила модель под Apache 2.0 и опубликовала результаты на семи coding-бенчмарках. По ключевым метрикам Codestral 2 близка к DeepSeek-Coder и опережает Qwen-2.5-Coder в той же весовой категории.
19 мая
3 мин
Модели
Релиз Llama 4 продолжил курс Meta на mixture-of-experts. Сравнение с DeepSeek-V3 показывает близкие результаты на бенчмарках при разных компромиссах по требованиям к VRAM. Что это значит для команд, выбирающих open-weight-стек.
15 мая
3 мин