Модели
xAI завершила вывод Grok 4.3 в общий доступ в первую неделю мая. Модель получила контекст в один миллион токенов, прибавила в агентных задачах и подешевела примерно на 40 процентов. Это отладка линейки Grok 4 перед переходом к Grok 5, а не новая архитектура.
11 июня
5 мин
Модели
Google DeepMind 10 июня 2026 года открыла веса DiffusionGemma — первой открытой LLM на текстовой диффузии. Модель генерирует блок из 256 токенов параллельно за один проход и работает до 4 раз быстрее авторегрессии, выдавая 1000+ токенов в секунду на одной H100.
10 июня
3 мин
Модели
9 июня Anthropic выпустила Claude Fable 5 — первую публичную модель класса Mythos с 95% на SWE-bench Verified. Mythos 5 без ограничений доступна только проверенным подрядчикам. Через три дня правительство США отозвало доступ к обеим моделям.
10 июня
5 мин
Модели
9 июня Anthropic выпустила Claude Fable 5 — версию закрытой модели Mythos, адаптированную для широкого доступа через API и подписку. Полная Claude Mythos 5 осталась доступна только партнёрам по кибербезопасности и отдельным исследователям в биологии.
9 июня
5 мин
Модели
YandexGPT глубже встроен в экосистему Яндекса и облачный API для разработчиков, а GigaChat от Сбера делает ставку на корпоративных клиентов и мультимодальность. Выбор между ними определяет не качество генерации, а то, какая экосистема уже используется в компании.
8 июня
5 мин
Модели
Mistral AI представила Mistral Large 3 — флагман с гибридной архитектурой и контекстом до 256K токенов, первый крупный релиз после раунда Series C на $1,2 млрд. Модель ориентирована на корпоративный сегмент: data-residency в ЕС и on-prem-развёртывание на инфраструктуре заказчика.
6 июня
5 мин
Модели
1 июня MiniMax представила M3 — модель с контекстом на миллион токенов, работой с видео и управлением экраном. Заявленные баллы выше GPT-5.5, но независимых проверок пока нет. Веса обещаны позже.
3 июня
3 мин
Модели
Команда Alibaba опубликовала семейство Qwen3 под лицензией Apache 2.0. Линейка включает плотные модели и MoE-варианты с упором на дешёвый инференс и длинный контекст. Релиз усиливает позиции открытых весов в сегменте, где задавали тон закрытые API.
30 мая
3 мин
Модели
Новый флагман Anthropic получил расширенный контекст до 500K токенов, нативное использование инструментов в режиме рассуждения и улучшенный coding-бенчмарк SWE-bench Verified на уровне 78,4%. Разбираем, для каких задач это уже сегодня меняет рабочий процесс.
24 мая
3 мин
Модели
Яндекс начал бета-доступ к новой версии модели. Заявленный рост качества на русскоязычных задачах рассуждения — до 22% по внутреннему бенчмарку, расширен набор инструментов API. Что вошло в релиз и где ещё видны ограничения.
23 мая
3 мин
Модели
Релиз сокращает задержку голосового и визуального ввода до уровня естественного диалога и вводит промежуточную тарифную ступень между Mini и стандартной моделью. Главные изменения и их практический эффект для команд, строящих real-time-приложения.
22 мая
3 мин
Модели
Модель Google DeepMind заняла первое место на новом бенчмарке длинного контекста с 2 миллионами токенов. Разбираем, в чём именно она опередила конкурентов, и какие ограничения этот результат не закрывает.
21 мая
3 мин