정의
RAG(검색 증강 생성)는 질문을 받으면 사내 문서에서 관련 내용을 먼저 찾아내고, 그 내용을 근거로 답을 만드는 방식입니다. 출처가 있는 답변이 가능해집니다.
업무 맥락 입력
매뉴얼 · 작업 이력
검색 결과를 바탕으로 생성
원문 검토
RAG(검색 증강 생성)는 질문을 받으면 사내 문서에서 관련 내용을 먼저 찾아내고, 그 내용을 근거로 답을 만드는 방식입니다. 출처가 있는 답변이 가능해집니다.
언어 모델만으로 답하게 하면 모델이 학습한 일반 지식에서 답을 만듭니다. 우리 회사의 설비 매뉴얼이나 작업 표준은 그 안에 없으므로, 그럴듯하지만 틀린 답이 나올 수 있습니다.
RAG는 이 문제를 답을 만들기 전에 근거를 찾는 단계를 넣어 해결합니다. 사내 문서를 미리 검색 가능한 형태로 준비해 두고, 질문이 들어오면 관련 부분을 찾아 그것을 근거로 답을 작성합니다. 어느 문서의 어느 부분을 봤는지 함께 제시할 수 있습니다.
제조 현장에서 RAG가 유용한 이유는 지식이 문서와 사람에게 흩어져 있기 때문입니다. 설비 매뉴얼, 작업 표준, 과거 알람 대응 이력이 각각 다른 곳에 있어 필요할 때 찾지 못합니다.
파인튜닝은 모델 자체를 우리 데이터로 다시 학습시키는 것이고, RAG는 모델은 그대로 두고 참고 자료를 붙여 주는 방식입니다. 문서가 자주 바뀌는 환경에서는 RAG가 유리합니다. 문서만 갱신하면 되고 재학습이 필요 없기 때문입니다.
함께 보면 이해가 빨라지는 용어입니다.
이유랩이 이 영역에서 제공하는 것입니다.
RAG를 검토할 때 자주 확인하는 내용입니다.
RAG는 모델을 새로 학습시키지 않으므로 별도의 학습 데이터가 필요하지 않습니다. 이미 가지고 있는 문서를 검색 가능한 형태로 정리하는 것에서 시작합니다.
온프레미스 구성으로 사내에 두고 운영할 수 있습니다. 데이터가 회사 밖으로 나가지 않는 것이 제조 현장에서 중요한 조건인 경우가 많습니다.
사내 문서를 근거로 하므로 그 문서에 쓰인 표현이 그대로 반영됩니다. 다만 같은 뜻의 다른 표현을 연결하려면 용어 정리가 도움이 됩니다.
설비 구성과 현재 업무 흐름을 확인하면 적용 범위가 정리됩니다.
상담 신청하기