용어집

RAG (검색 증강 생성)란 무엇인가요?

RAG, 즉 검색 증강 생성은 AI 모델이 답을 만들기 전에 먼저 원문에서 관련 구절을 찾아내고, 그 구절을 근거로 답하도록 하는 방식입니다.

평범한 대규모 언어 모델은 학습 데이터를 바탕으로 답합니다. 그런데 학습 시점에 고정된 지식만 갖고 있고, 사실을 지어내는 환각 현상도 일으킵니다. RAG는 여기에 검색 단계를 더해 이를 보완합니다 — 사용자의 질문이 들어오면 시스템은 코퍼스(책, PDF, 지식 베이스)에서 가장 관련 깊은 구절을 찾고, 그것을 맥락으로 모델에 건넨 뒤에야 답을 부탁합니다.

요약 및 사용 가능한 출처 맥락과 대화

RAG의 품질은 세 가지에 달려 있습니다 — 원문을 어떻게 쪼개는지(문단·절·문장), 그 조각을 유사도 검색을 위해 어떻게 임베딩하는지, 그리고 모델에게 찾은 맥락을 어떻게 쓰라고 지시하는지. 셋 중 하나라도 약하면, 형식상으로는 출처에 묶여 있어도 사실은 틀린 답이 나옵니다.

Summio의 자리

요약 및 사용 가능한 출처 맥락과 대화

Summio에 대해 더 알아보기

자주 묻는 질문

RAG는 파인튜닝과 어떻게 다른가요?

파인튜닝은 새 지식을 모델 가중치에 새깁니다 — 느리고 비싸며, 재학습 외에는 갱신할 방법이 없습니다. RAG는 모델을 그대로 두고 질의마다 가져오는 맥락만 바꿉니다. 지식을 갱신한다는 건 문서를 다시 색인한다는 뜻이지, 모델을 다시 학습한다는 뜻이 아닙니다.

RAG가 환각을 없애 주나요?

검색은 답변을 출처에 더 가깝게 근거 지을 수 있지만 환각을 없애지는 못합니다. 모델이 구절을 잘못 읽거나 무시하고, 맞는 세부 정보를 잘못 결합할 수 있으므로 중요한 내용은 원문과 대조하세요.

RAG는 어디에 쓰이나요?

AI 검색 엔진(Perplexity, ChatGPT search, 웹 접근이 가능한 Claude), 내부 문서와의 채팅, 헬프센터 위의 고객 지원 봇, 그리고 Summio 같은 독서 앱. 답이 특정 출처에 묶여야 하는 모든 자리에 쓰입니다.