Глосарій

RAG (Retrieval-Augmented Generation)

RAG — архітектурний патерн, що доповнює LLM актуальними даними з зовнішнього сховища. Замість того щоб «пам'ятати» всі факти в параметрах моделі, потрібна інформація знаходиться під час запиту і передається в контекст.

Схема RAG

  1. Користувач задає питання
  2. Система векторним пошуком знаходить релевантні документи
  3. Документи додаються до промпта як контекст
  4. LLM генерує відповідь на основі контексту

Переваги

Коли потрібен

Q&A по корпоративній документації, пошук у великій базі знань, chatbot що відповідає на питання по продукту.