ContextWindow
Тег

#open-weights

Модели

Google DeepMind выпустила DiffusionGemma: открытая текстовая диффузия и до 4x скорости

Google DeepMind 10 июня 2026 года открыла веса DiffusionGemma — первой открытой LLM на текстовой диффузии. Модель генерирует блок из 256 токенов параллельно за один проход и работает до 4 раз быстрее авторегрессии, выдавая 1000+ токенов в секунду на одной H100.

Модели

Mistral выпускает Large 3: флагман с 256K-контекстом и европейской data-residency

Mistral AI представила Mistral Large 3 — флагман с гибридной архитектурой и контекстом до 256K токенов, первый крупный релиз после раунда Series C на $1,2 млрд. Модель ориентирована на корпоративный сегмент: data-residency в ЕС и on-prem-развёртывание на инфраструктуре заказчика.

Модели

Alibaba открыла веса Qwen3: ставка на эффективность инференса

Команда Alibaba опубликовала семейство Qwen3 под лицензией Apache 2.0. Линейка включает плотные модели и MoE-варианты с упором на дешёвый инференс и длинный контекст. Релиз усиливает позиции открытых весов в сегменте, где задавали тон закрытые API.

Модели

HuggingFace выпустил SmolLM3: 3B-модель уровня 7B-класса

Дистилляция и пересборка тренировочного корпуса дали результат, опередивший Mistral 7B на восьми из десяти задач MMLU-Pro. Что стоит за этим скачком и почему это важно для команд, работающих на edge-устройствах.

Модели

Llama 4 MoE: что архитектура Meta меняет для команд на self-hosted-инфраструктуре

Релиз Llama 4 продолжил курс Meta на mixture-of-experts. Сравнение с DeepSeek-V3 показывает близкие результаты на бенчмарках при разных компромиссах по требованиям к VRAM. Что это значит для команд, выбирающих open-weight-стек.