ContextWindow
Рубрика

Модели

Большие языковые модели и нейросети: релизы, архитектуры, бенчмарки и практические сравнения. GPT, Claude, Gemini, DeepSeek, Llama и российские модели — что вышло, как считает и где применимо на практике.
Модели

Grok 4.3 стал основной моделью xAI: миллион токенов контекста и цена ниже почти на 40%

xAI завершила вывод Grok 4.3 в общий доступ в первую неделю мая. Модель получила контекст в один миллион токенов, прибавила в агентных задачах и подешевела примерно на 40 процентов. Это отладка линейки Grok 4 перед переходом к Grok 5, а не новая архитектура.

Модели

Google DeepMind выпустила DiffusionGemma: открытая текстовая диффузия и до 4x скорости

Google DeepMind 10 июня 2026 года открыла веса DiffusionGemma — первой открытой LLM на текстовой диффузии. Модель генерирует блок из 256 токенов параллельно за один проход и работает до 4 раз быстрее авторегрессии, выдавая 1000+ токенов в секунду на одной H100.

Модели

Anthropic выпустила Claude Fable 5 и Mythos 5 — и потеряла доступ к ним за три дня

9 июня Anthropic выпустила Claude Fable 5 — первую публичную модель класса Mythos с 95% на SWE-bench Verified. Mythos 5 без ограничений доступна только проверенным подрядчикам. Через три дня правительство США отозвало доступ к обеим моделям.

Модели

Anthropic открыла публичный доступ к Claude Fable 5 — модели класса Mythos для кибербезопасности

9 июня Anthropic выпустила Claude Fable 5 — версию закрытой модели Mythos, адаптированную для широкого доступа через API и подписку. Полная Claude Mythos 5 осталась доступна только партнёрам по кибербезопасности и отдельным исследователям в биологии.

Модели

YandexGPT и GigaChat: сравнение двух главных российских языковых моделей

YandexGPT глубже встроен в экосистему Яндекса и облачный API для разработчиков, а GigaChat от Сбера делает ставку на корпоративных клиентов и мультимодальность. Выбор между ними определяет не качество генерации, а то, какая экосистема уже используется в компании.

Модели

Mistral выпускает Large 3: флагман с 256K-контекстом и европейской data-residency

Mistral AI представила Mistral Large 3 — флагман с гибридной архитектурой и контекстом до 256K токенов, первый крупный релиз после раунда Series C на $1,2 млрд. Модель ориентирована на корпоративный сегмент: data-residency в ЕС и on-prem-развёртывание на инфраструктуре заказчика.

Модели

Alibaba открыла веса Qwen3: ставка на эффективность инференса

Команда Alibaba опубликовала семейство Qwen3 под лицензией Apache 2.0. Линейка включает плотные модели и MoE-варианты с упором на дешёвый инференс и длинный контекст. Релиз усиливает позиции открытых весов в сегменте, где задавали тон закрытые API.

Модели

Anthropic выпустила Claude Opus 4.7: что меняется для разработчиков и команд

Новый флагман Anthropic получил расширенный контекст до 500K токенов, нативное использование инструментов в режиме рассуждения и улучшенный coding-бенчмарк SWE-bench Verified на уровне 78,4%. Разбираем, для каких задач это уже сегодня меняет рабочий процесс.

Модели

Yandex GPT 5 Pro: открытое тестирование и расширение API

Яндекс начал бета-доступ к новой версии модели. Заявленный рост качества на русскоязычных задачах рассуждения — до 22% по внутреннему бенчмарку, расширен набор инструментов API. Что вошло в релиз и где ещё видны ограничения.

Модели

OpenAI обновила GPT-5o: голос и зрение в реальном времени, новый ценовой тир

Релиз сокращает задержку голосового и визуального ввода до уровня естественного диалога и вводит промежуточную тарифную ступень между Mini и стандартной моделью. Главные изменения и их практический эффект для команд, строящих real-time-приложения.

Модели

Gemini 2.5 Pro лидирует на RULER-2M: что показал бенчмарк длинного контекста

Модель Google DeepMind заняла первое место на новом бенчмарке длинного контекста с 2 миллионами токенов. Разбираем, в чём именно она опередила конкурентов, и какие ограничения этот результат не закрывает.