Инъекция промптов для LLM с длинным контекстом как альтернатива RAG?

ДОПОЛНЕНИЕ 2

Вот тест в формате вопрос-ответ с использованием белого документа (~20 тыс. токенов) в контексте инъекции промптов против RAG (контент и настройки были максимально идентичны. LLM = Gemini-1.5-Pro).

АНАЛИЗ:

RAG работает нестабильно: иногда находит ответ, иногда нет.


:github_check: Успешная инъекция промпта:


:x: Сбой RAG:


Трассировка запроса RAG:

Мне удалось заставить RAG отвечать на вопросы из загруженного файла в начале документа, а при настойчивости он может обращаться и к середине, и к концу… так что это не полный провал. Однако он работает нестабильно и, на мой взгляд, с ним сложнее иметь дело : )