Skip to main content

RAG

RAG: chunking документов → embeddings → vector DB → similarity search → найденный контекст → chat model.
Качество RAG зависит от chunking, metadata, фильтров доступа и reranking не меньше, чем от модели.