Инъекция промптов для LLM с длинным контекстом как альтернатива RAG?

Но разве это не просто (очень неэффективная) «статическая» версия RAG?

Единственное отличие RAG от этого подхода заключается в том, что она выбирает и включает релевантные фрагменты контента, а не весь контент целиком.