ContextWindow
Тег

#rag

Инструменты

RAG (retrieval-augmented generation): как работает пайплайн и зачем он нужен

RAG (retrieval-augmented generation) — архитектурный паттерн, при котором языковая модель перед генерацией ответа получает релевантные фрагменты из внешней базы знаний. Подход снижает галлюцинации и открывает доступ к данным, которых нет в весах модели.

Бизнес

Cohere свернула потребительские продукты и сфокусировалась на enterprise-поиске

22 мая Cohere объявила о раунде $500 млн Series E и одновременно закрыла все потребительские и developer-направления. Компания сворачивает прямые API-подписки для индивидуальных разработчиков и концентрируется на RAG-инфраструктуре для крупного бизнеса.

Инструменты

Vector DB на 100M+ векторах: где сейчас Pinecone, Weaviate и Qdrant

На корпусе из 120 миллионов векторов разница между Pinecone, Weaviate и Qdrant перестаёт быть теоретической — она влияет на бюджет, архитектуру и операционную нагрузку команды. Latency p95, recall и совокупная стоимость владения на реальной нагрузке.