ContextWindow
Тег

#nlp

Инструменты

RAG (retrieval-augmented generation): как работает пайплайн и зачем он нужен

RAG (retrieval-augmented generation) — архитектурный паттерн, при котором языковая модель перед генерацией ответа получает релевантные фрагменты из внешней базы знаний. Подход снижает галлюцинации и открывает доступ к данным, которых нет в весах модели.

Исследования

Сколтех и Яндекс опубликовали методологию токенизатора для русского языка

7 мая Сколтех и Yandex Research опубликовали препринт с методологией токенизатора, оптимизированного под русскоязычные корпуса. Заявленное снижение средней длины последовательности — 14–18% по сравнению с tiktoken cl100k. При больших объёмах запросов это напрямую конвертируется в деньги.