Глоссарий

RAG (Retrieval-Augmented Generation)

RAG — архитектурный паттерн, дополняющий LLM актуальными данными из внешнего хранилища. Вместо того чтобы «запоминать» все факты в параметрах модели, нужная информация находится во время запроса и передаётся в контекст.

Схема RAG

  1. Пользователь задаёт вопрос
  2. Система векторным поиском находит релевантные документы
  3. Документы добавляются в промпт как контекст
  4. LLM генерирует ответ на основе контекста

Преимущества

Когда нужен

Q&A по корпоративной документации, поиск в большой базе знаний, чатбот, отвечающий на вопросы по продукту.