RAG (генерация с поиском)
Также: RAG, retrieval augmented generation, дополненная генерация
Подход, когда модель перед ответом подтягивает нужные документы и отвечает на их основе.
RAG (retrieval-augmented generation) — это связка «поиск + генерация». Перед тем как ответить, система находит релевантные фрагменты в базе знаний (документации, статьях, коде) и подаёт их модели в контекст. Модель отвечает, опираясь на эти данные.
Так решают две проблемы: ограниченное контекстное окно (подаём только нужное) и галлюцинации (модель опирается на реальные документы, а не на догадки).
RAG лежит в основе корпоративных ИИ-помощников «по нашей документации» и чат-ботов по базе знаний. Технически часто использует эмбеддинги для поиска по смыслу.