Iniezione di prompt per LLM a lungo contesto come alternativa a RAG?

ADDENDUM 2

Ecco un test Q/A con un white paper (~20k token) messo in contesto tramite prompt injection vs RAG. (contenuto e impostazioni sono stati il più possibile gli stessi. LLM = Gemini-1.5-Pro)..

ANALISI:
RAG è incoerente.. a volte trova la risposta, a volte la manca.


:github_check: Successo prompt injection:


:x: Fallimento RAG:


Traccia richiesta RAG:

Sono riuscito a far rispondere RAG alle domande dall’upload del file all’inizio del documento e, con qualche sforzo, potrebbe guardare al centro e alla fine.. quindi non è un fallimento totale.. ma è incoerente… costantemente, o più difficile da gestire secondo me : )