長文脈LLMにおけるプロンプトインジェクションはRAGの代替となりうるか?

ADDENDUM 2

プロンプトインジェクション vs RAG を使用して、ホワイトペーパー(約2万トークン)をコンテキスト化したQ/Aテストです。(コンテンツと設定は可能な限り同じにしました。LLM = Gemini-1.5-Pro)。

分析:
RAGは一貫性がありません。時々答えを見つけ、時々見逃します。


:github_check: プロンプトインジェクション成功:


:x: RAG失敗:


RAGリクエストトレース:

文書の冒頭でファイルアップロードからの質問にRAGで回答させることはできましたが、少し促せば、中盤や終盤の質問にも対応できるかもしれません。したがって、完全に失敗したわけではありませんが、一貫性がありません。私の意見では、一貫性がない、または扱いにくいです : )