RAG (Retrieval-Augmented Generation)
Në shqip përdoret i njëjti emër.
ShpjegimiSQ
RAG është një teknikë ku, para se LLM-ja të përgjigjet, programi gjen dokumentet më të përshtatshme (p.sh. me embedding-e) dhe ia jep modelit bashkë me pyetjen. Kështu përgjigjja bazohet në informacion të vërtetë dhe të freskët, jo vetëm në kujtesën e modelit.
EnglishEN
RAG is a technique where, before the LLM answers, the program finds the most relevant documents (e.g. using embeddings) and gives them to the model along with the question. That way the answer is based on real, up-to-date information, not just the model's memory.
Si ta mendosh
Si provimi me libër të hapur: në vend që të mbështetesh vetëm te kujtesa, e gjen faqen e duhur në libër dhe përgjigjesh duke u bazuar aty.
Lexoje në anglisht
Like an open-book exam: instead of relying only on memory, you find the right page in the book and base your answer on it.