30

RAG: 검색 + 생성의 결합

Day 1: RAG 개요 & 제조 문서 이해

학습 목표

RAG(Retrieval-Augmented Generation)의 정의를 설명할 수 있다 RAG와 순수 LLM의 차이를 구분할 수 있다 RAG 파이프라인의 3단계를 이해한다

RAG란?

RAG = Retrieval-Augmented Generation (검색 증강 생성)

한 문장으로: "내 문서에서 찾아서 답변하게 만드는 기술"


LLM만 쓰면 안 되나?

GPT-4o에게 직접 물어보자:

질문: "CNC-3000 서보 에러 E-001 해결 방법?"

GPT-4o 답변:
"일반적으로 CNC 서보 에러는 다음과 같은 원인이 있습니다:
 1. 모터 과부하
 2. 인코더 이상
 3. 케이블 단선..."

문제: "일반적으로"라고 한다.
      우리 회사 CNC-3000 매뉴얼을 본 적이 없다.
      파라미터 #2012 같은 구체적 정보가 없다.
      틀린 정보를 그럴듯하게 말할 수 있다 (환각).

LLM의 3가지 한계

한계설명제조 현장 영향
지식 한계학습 데이터에 없는 정보는 모른다우리 회사 매뉴얼을 모른다
환각(Hallucination)모르는 걸 그럴듯하게 지어낸다잘못된 절차로 설비 파손 위험
최신성학습 시점 이후 정보를 모른다최신 SOP 반영 불가

제조에서 환각은 치명적이다. 잘못된 파라미터 하나가 수억 원 장비를 망가뜨린다.


RAG의 해결법: 내 문서에서 찾아서 답하라

                    RAG 파이프라인 3단계
                    ==================

   [1단계: 색인(Indexing)]
   ┌──────────┐    ┌──────────┐    ┌──────────┐
   │ 문서 수집 │ -> │   청킹   │ -> │  벡터화  │ -> Vector DB 저장
   │ PDF/TXT  │    │  분할    │    │ 임베딩   │
   └──────────┘    └──────────┘    └──────────┘

   [2단계: 검색(Retrieval)]
   ┌──────────┐    ┌──────────┐    ┌──────────┐
   │ 사용자   │ -> │ 질문     │ -> │ 유사도   │ -> 관련 문서 Top-K
   │ 질문     │    │ 벡터화   │    │ 검색     │
   └──────────┘    └──────────┘    └──────────┘

   [3단계: 생성(Generation)]
   ┌──────────┐    ┌──────────┐    ┌──────────┐
   │ 관련     │ -> │ 프롬프트 │ -> │   LLM    │ -> 근거 있는 답변
   │ 문서들   │    │ 조합     │    │  생성    │
   └──────────┘    └──────────┘    └──────────┘

순수 LLM vs RAG 비교

항목순수 LLMRAG
지식 범위학습 데이터만학습 데이터 + 내 문서
정확도일반적 답변문서 기반 정확한 답변
환각 위험높음낮음 (출처 검증 가능)
최신성학습 시점까지문서 업데이트 시 즉시 반영
비용매번 API 호출색인 1회 + API 호출
출처제공 불가문서명, 페이지 번호 제공

제조 현장에서 "출처"는 단순한 부가 기능이 아니다. ISO 감사, 사고 조사, 책임 추적에 필수다.


RAG가 가져오는 변화: 실제 사례

[반도체 FAB - S사]
Before: 매뉴얼 검색 30분 → After: RAG 검색 30초 (60배 단축)
Before: 신입 온보딩 6개월 → After: 3개월 (50% 단축)
Before: 다운타임 평균 45분 → After: 38분 (15% 단축)

[자동차 부품사 - H사]
Before: 규격 조회 1시간 → After: 2분
Before: 품질감사 준비 2주 → After: 3일 (70% 단축)
Before: 문서 버전 오류 월 5건 → After: 0건

[제약사 - C사]
Before: FDA 감사 대응 3일 → After: 반나절 (80% 단축)
Before: 문서 추적 수작업 → After: 자동 100% 추적

이 숫자들은 과장이 아니다. 문서 검색이 빨라지면 모든 것이 빨라진다.

AI로 학습하기 — 꿀팁
RAG vs 순수 LLM 차이 환각 점검AI 학습 팁

RAG와 순수 LLM의 차이는 자주 잘못 설명되므로, AI 설명의 정확성을 비판적으로 검증하는 훈련이 중요하다.

RAG(Retrieval-Augmented Generation)와 순수 LLM의 차이에 대해 다음 설명이 맞는지 검증해줘: 'RAG는 LLM의 파라미터를 업데이트하여 새 지식을 학습한다', 'RAG는 항상 파인튜닝보다 비용이 저렴하다', 'RAG의 검색 단계는 반드시 벡터 유사도 검색만 사용한다', 'RAG는 환각(Hallucination)을 완전히 제거한다'. 각 문장에 대해 맞음/틀림을 판정하고, 틀린 경우 제조 설비 문서 RAG 시스템을 예시로 들어 올바른 설명을 해줘.
이 팁이 도움이 됐나요?