ContextWindow
Рубрика

Модели

Большие языковые модели и нейросети: релизы, архитектуры, бенчмарки и практические сравнения. GPT, Claude, Gemini, DeepSeek, Llama и российские модели — что вышло, как считает и где применимо на практике.
Модели

HuggingFace выпустил SmolLM3: 3B-модель уровня 7B-класса

Дистилляция и пересборка тренировочного корпуса дали результат, опередивший Mistral 7B на восьми из десяти задач MMLU-Pro. Что стоит за этим скачком и почему это важно для команд, работающих на edge-устройствах.

Модели

Llama 4 MoE: что архитектура Meta меняет для команд на self-hosted-инфраструктуре

Релиз Llama 4 продолжил курс Meta на mixture-of-experts. Сравнение с DeepSeek-V3 показывает близкие результаты на бенчмарках при разных компромиссах по требованиям к VRAM. Что это значит для команд, выбирающих open-weight-стек.

Модели

Anthropic заявляет о достижении $4 млрд ARR на корпоративном сегменте

По данным компании, годовая выручка по подписке достигла $4 млрд при росте за квартал на 28%. Основной драйвер — корпоративный сегмент и интеграция Claude Code в кодовые базы крупных технологических компаний.