book

RAG with Python 쿡북 (Korean Edition)

Name: RAG with Python 쿡북 (Korean Edition)
Author: Dominik Polzer
ISBN: 0642572383596

by Dominik Polzer

May 2026

Intermediate

378 pages

5h 49m

Korean

O'Reilly Media, Inc.

Read now

Unlock full access

서문
이 책의 대상 독자이 책에서 배울 내용과 구성이 책에서 사용하는 표기법코드 예제 활용O’Reilly 온라인 학습문의 방법감사의 말
1. RAG 시작하기
1.1.조직에적합한 고부가가치 RAG 사용 사례 파악하기1.2. IDE 선택 및 코딩 에이전트 설정1.3. VS Code에서 Jupyter Notebook 시작하기1.4. .env 파일을 이용한 비밀 정보 및 API 키 저장1.5. 첫 번째 RAG 앱 구축1.6.RAG 애플리케이션을 위한 프레임워크 및 라이브러리 선택1.7. 책 저장소의 코드 예제 실행하기
2. 파운데이션 모델
2.1. 적합한 prompt 템플릿 정의하기2.2. 작업에 적합한 언어 모델 선택2.3. OpenAI API를 사용하여 콘텐츠 생성하기2.4. Google의 Gemini 모델을 사용하여 콘텐츠 생성하기2.5. Anthropic API를 사용하여 콘텐츠 생성하기2.6. Ollama를 사용하여 로컬에서 오픈 소스 모델 실행하기2.7.OpenAI SDK 및 Pydantic을 사용하여 구조화된 출력 생성하기
3. 데이터 불러오기
3.1. Python에서 Word 파일 불러오기3.2. PDF 파일 불러오기3.3. Excel 및 CSV 파일에서 표 형식 데이터 불러오기 및 처리3.4. PostgreSQL 데이터베이스에서 구조화된 데이터 불러오기3.5. 음성-텍스트 변환 모델을 통한 오디오 파일 불러오기3.6.Tesseract OCR을 이용한 이미지 및 PDF에서 텍스트 추출3.7. 다중 모달 모델을 통한 이미지에서 텍스트 추출3.8. 다중 모달 모델을 통한 이미지 텍스트 설명 생성3.9. 다중 모달 모델을 사용하여 삽입된 표에 대한 텍스트 요약 생성3.10. 다중 모달 콘텐츠가 포함된 PDF 분석3.11. 음성-텍스트 변환 및 다중 모달 모델을 통한 동영상 로딩
4. 데이터 전처리
4.1. 메타데이터 필터링 기능을 위한 메타데이터 추가4.2. 약어 및 전문 용어 대체를 통한 데이터 품질 향상4.3. 텍스트 청크에 대한 가설적 질문 생성을 통한 검색 정확도 향상4.4. 문자 단위 분할을 통한 문서 분할4.5. 재귀적 텍스트 분할기를 이용한 문서 분할4.6. 문서 인식 분할을 통한 문서 청크화4.7. 의미 인식 청커를 이용한 텍스트 분할4.8. 행위자 기반 청커를 이용한 텍스트 분할
5. 임베딩
5.1. 텍스트 청크의 언어적 의미를 수치적 표현으로 매핑하기5.2. 차원 축소 기법을 통한 텍스트 청크 간 의미적 관계 시각화5.3. 임베딩 간의 거리 계산5.4. 적절한 임베딩 모델 선택5.5. CLIP을 이용한 이미지 및 텍스트 임베딩 생성5.6. 임베딩을 활용한 텍스트 분류 수행5.7. 하이브리드 검색 접근법을 통한 검색 결과 개선
6. 벡터 데이터베이스 및 유사도 검색
6.1. 적합한 벡터 데이터베이스 선택6.2. FAISS를 이용한 임베딩 저장 및 검색6.3. Chroma 벡터 데이터베이스에서 임베딩 저장 및 활용6.4.pgvector 확장 기능을 사용하여 PostgreSQL에 임베딩 저장하기6.5. PostgreSQL에서 유사도 검색 수행하기6.6. 인덱싱 기법을 활용한 PostgreSQL 벡터 검색 가속화6.7. PostgreSQL에서 키워드 검색과 유사도 검색을 결합하여 검색 정확도 향상
7. 검색
7.1. PostgreSQL에서 메타데이터 필터링을 통한 쿼리 결과 최적화7.2. HyDE를 활용한 검색 정확도 향상7.3. 다중 쿼리 검색을 통한 검색 결과 개선7.4. 쿼리 라우팅 시스템 설계를 통한 복잡한 요청 처리7.5. 자동 병합 검색기 설계를 통한 검색 문서 품질 향상7.6. 문장 창 검색기를 활용한 보다 완전한 텍스트 청크 검색7.7.재순위 지정 기법을 통한 검색 관련성 향상7.8. 복잡한 쿼리를 여러 하위 쿼리로 분해
8. 에이전트 기반 RAG
8.1. Python을 이용한 맞춤형 도구 설계8.2. 다중 에이전트 시스템에서 워크플로 패턴 활용8.3. 에이전트 기반 프레임워크 선택8.4. 함수 호출을 통한 에이전트 시스템 구축8.5. asyncio를 이용한 에이전트 가속화8.6. OpenAI의 에이전트 SDK와 Chroma를 활용한 영업 협상 에이전트 구축8.7. MCP 도구를 활용한 에이전트 기능 강화8.8. LangGraph를 활용한 에이전트 시스템 구축
9. 그래프 RAG
9.1. 첫 번째 Neo4j 지식 그래프 생성 및 문서 텍스트 입력9.2. 구조화된 데이터를 활용한 지식 그래프 확장9.3. 첫 번째 Cypher 쿼리 작성하기9.4.Neo4j 지식 그래프에서 시맨틱 검색 활성화9.5. RAG 시스템을 위한 지식 그래프 최적화

10. RAG 시스템 평가
10.1.RAG 시스템에 적합한 평가 지표 선택10.2. 인간을 통한 RAG 시스템 평가10.3. 자동화된 테스트를 위한 합성 데이터 생성10.4. Context Precision@k 계산으로 검색 단계 평가10.5.LLM-as-a-Judge를 활용한 생성 과정 중 정확도 평가10.6.RAG 시스템의 응답 관련성 평가
11. RAG 웹 애플리케이션
11.1. 첫 번째 Streamlit 앱 구축11.2. Streamlit을 활용한 챗봇 앱 구축11.3. 챗봇에 PDF 분석기 기능 추가하기11.4. RAG 앱을 SQL 데이터베이스에 연결하기11.5. Docker 및 AWS를 사용하여 Streamlit 앱 배포하기
목차
저자 소개

Content preview from RAG with Python 쿡북 (Korean Edition)

제9장. 그래프 RAG

이 작품은 AI를 사용하여 번역되었습니다. 여러분의 피드백과 의견을 환영합니다: translation-feedback@oreilly.com

그래프 RAG는 기본 검색 기능을 확장하여 그래프 탐색( )을 도입함으로써, 고립된 텍스트 임베딩의 의미적 유사성에만 의존하는 대신 엔티티와 관계의 네트워크를 탐색할 수 있게 해줍니다.

기본적인 RAG 시스템은 문서를 조각으로 분할하여 임베딩한 후, 벡터 검색을 통해 관련 콘텐츠를 도출합니다. 벡터 검색은 각 조각을 독립된 단위로 취급하므로, 더 넓은 서사 속에서 조각들이 어떻게 연결되는지 인식하지 못합니다. 정보가 긴 문서의 여러 부분에 분산되어 있거나 여러 출처의 데이터가 필요한 경우, 이러한 접근 방식은 관련 맥락을 놓치게 됩니다. 섹션 간에 존재하는 종속성, 참조, 관계가 상실되는 것입니다.

그래프 RAG는 이러한 격차를 해소합니다. 텍스트를 단순히 임베딩으로 저장하는 대신, 엔티티를 추출하고 이들 간에 명시적인 관계를 형성하며, 이 그래프 구조를 벡터 인덱스와 결합합니다. 이를 통해 더 풍부하고 정밀한 맥락을 생성하며, 엔티티 간의 명시적인 연결을 보존합니다.

그림 9-1은 계약서 문서 데이터를 사용하여 기본 RAG와 그래프 RAG의 차이를 보여줍니다. 기본 RAG 설정에서 시스템은 고립된 임베딩 벡터 풀을 유지합니다. 반면 그래프 RAG에서는 모든 텍스트 스니펫이 주변 구조에 고정됩니다. 각 조항은 해당 조항 유형, 회사, 주소, 그리고 해당 조항이 유래한 서비스 수준 계약(SLA)과 연결됩니다. 이러한 구조적 컨텍스트는 모델이 관련 텍스트를 찾을 뿐만 아니라, 그 텍스트가 어디에 속하는지 진정으로 이해하는 데 도움을 줍니다.

Diagram comparing Basic RAG with Graph RAG, showing how Graph RAG anchors text snippets to their structural context, enhancing understanding and retrieval.

그래프 RAG 시스템을 구축하려면 기존의 검색기를 그래프 데이터베이스로 대체합니다. 이 장에서는 모든 그래프 예제에 Neo4j를 사용합니다.

그래프가 채워지면 검색 흐름은 일반적으로 다음 네 단계를 따릅니다:

초기 검색: 벡터 검색이나 전체 텍스트 검색 중 하나로 시작하여 관련 노드를 식별합니다. 이 노드들이 앵커 포인트 역할을 합니다.
그래프 확장: 앵커 노드에서 시작하여, 일반적으로 1~2단계의 경로를 통해 그래프를 탐색하며 관련 노드와 에지를 수집합니다.
(선택 사항) 필터링 및 순위 지정: 확장된 결과 집합을 정제하여 의미 있는 맥락을 제공하는 노드만 남깁니다.
컨텍스트 조립 및 생성: 원본 앵커 텍스트와 연결된 컨텍스트를 모두 LLM에 입력합니다.

이 프로세스는 의미적 매칭과 구조적 추론을 결합하여 의미와 연결 관계를 모두 반영하는 맥락을 생성합니다. 그림 9-2는 주요 검색 프로세스를 보여줍니다.

그림 9-2. 그래프 RAG 검색의단계

이 장에서는 첫 번째 지식 그래프를 구축하고, 문서의 ...

Become an O’Reilly member and get unlimited access to this title plus top books and audiobooks from O’Reilly and nearly 200 top publishers, thousands of courses curated by job role, 150+ live events each month,
and much more.

Read now

Unlock full access

More than 5,000 organizations count on O’Reilly

O’Reilly covers everything we've got, with content to help us build a world-class technology community, upgrade the capabilities and competencies of our teams, and improve overall team performance as well as their engagement.

Julian F.

Head of Cybersecurity

I wanted to learn C and C++, but it didn't click for me until I picked up an O'Reilly book. When I went on the O’Reilly platform, I was astonished to find all the books there, plus live events and sandboxes so you could play around with the technology.

Addison B.

Field Engineer

I’ve been on the O’Reilly platform for more than eight years. I use a couple of learning platforms, but I'm on O'Reilly more than anybody else. When you're there, you start learning. I'm never disappointed.

Amir M.

Data Platform Tech Lead

I'm always learning. So when I got on to O'Reilly, I was like a kid in a candy store. There are playlists. There are answers. There's on-demand training. It's worth its weight in gold, in terms of what it allows me to do.

Mark W.

Embedded Software Engineer

Tips for Designing Effective Presentation Slide Decks

Publisher Resources

ISBN: 0642572383596

Cloud Computing

Data Engineering

Data Science

AI & ML

Programming Languages

Software Architecture

IT/Ops

Security

Design

Business

Soft Skills

RAG with Python 쿡북 (Korean Edition)

by Dominik Polzer

제9장. 그래프 RAG

그림 9-1. 그래프 RAG 대 기존 벡터 검색

그림 9-2. 그래프 RAG 검색의단계

Become an O’Reilly member and get unlimited access to this title plus top books and audiobooks from O’Reilly and nearly 200 top publishers, thousands of courses curated by job role, 150+ live events each month,
and much more.