ContextWindow
Тег

#llm

Модели

YandexGPT и GigaChat: сравнение двух главных российских языковых моделей

YandexGPT глубже встроен в экосистему Яндекса и облачный API для разработчиков, а GigaChat от Сбера делает ставку на корпоративных клиентов и мультимодальность. Выбор между ними определяет не качество генерации, а то, какая экосистема уже используется в компании.

Бизнес

Внедрение ИИ в компании: выбор сценария, архитектура и оценка затрат

Большинство корпоративных проектов с ИИ застревают не на этапе обучения модели, а раньше — когда нет ответа на вопрос, какую задачу решаем первой. Практический маршрут: от выбора use case до расчёта стоимости инференса и измерения отдачи.

Инструменты

ИИ-агенты: архитектура, принцип работы и пределы надёжности

ИИ-агент — программная система на основе языковой модели, которая самостоятельно планирует и выполняет многошаговые задачи: вызывает инструменты, наблюдает результат и определяет следующий шаг. Чат-бот этого не делает.

Инструменты

RAG (retrieval-augmented generation): как работает пайплайн и зачем он нужен

RAG (retrieval-augmented generation) — архитектурный паттерн, при котором языковая модель перед генерацией ответа получает релевантные фрагменты из внешней базы знаний. Подход снижает галлюцинации и открывает доступ к данным, которых нет в весах модели.

Исследования

Контекстное окно в языковых моделях: что это такое и почему его размер имеет значение

Контекстное окно — максимальный объём текста в токенах, который языковая модель обрабатывает за один вызов; всё за его пределами модель не видит. Размер окна определяет, сколько документа, кода или диалога умещается в один запрос.

Инструменты

OpenAI переводит Agents SDK в стабильную версию 1.0

OpenAI выпустила стабильный релиз Agents SDK 1.0 — инструментария для оркестрации многошаговых агентов. Библиотека вышла из беты с поддержкой MCP, guardrails и eval-харнессом. Для команд на сыром API появился готовый рантайм с хостингом прогонов.

Модели

Mistral выпускает Large 3: флагман с 256K-контекстом и европейской data-residency

Mistral AI представила Mistral Large 3 — флагман с гибридной архитектурой и контекстом до 256K токенов, первый крупный релиз после раунда Series C на $1,2 млрд. Модель ориентирована на корпоративный сегмент: data-residency в ЕС и on-prem-развёртывание на инфраструктуре заказчика.

Модели

Alibaba открыла веса Qwen3: ставка на эффективность инференса

Команда Alibaba опубликовала семейство Qwen3 под лицензией Apache 2.0. Линейка включает плотные модели и MoE-варианты с упором на дешёвый инференс и длинный контекст. Релиз усиливает позиции открытых весов в сегменте, где задавали тон закрытые API.

Модели

Anthropic выпустила Claude Opus 4.7: что меняется для разработчиков и команд

Новый флагман Anthropic получил расширенный контекст до 500K токенов, нативное использование инструментов в режиме рассуждения и улучшенный coding-бенчмарк SWE-bench Verified на уровне 78,4%. Разбираем, для каких задач это уже сегодня меняет рабочий процесс.

Модели

Yandex GPT 5 Pro: открытое тестирование и расширение API

Яндекс начал бета-доступ к новой версии модели. Заявленный рост качества на русскоязычных задачах рассуждения — до 22% по внутреннему бенчмарку, расширен набор инструментов API. Что вошло в релиз и где ещё видны ограничения.