RAG (Retrieval-Augmented Generation)
문서를 올려두고 질문 시점에 관련 조각을 검색해 LLM이 답을 생성하는 방식. NotebookLM, ChatGPT 파일 업로드, 대부분의 문서 QA 시스템이 이 방식. (출처: LLM Wiki)
한계: 누적이 없다. 여러 문서를 종합해야 하는 질문은 매번 조각을 다시 찾아 조립한다. 상호참조·모순 확인이 저장되지 않는다.
대안: LLM Wiki. 원본 투입 시점에 지식을 컴파일해 두고 유지한다. 단, 위키 규모가 커지면 검색(qmd 등)은 여전히 필요하다.