fos-blog/study
01 / 홈02 / 카테고리03 / 시리즈
01 / 홈02 / 카테고리03 / 시리즈

카테고리

  • AI 페이지로 이동
    • RAG 페이지로 이동
    • agent 페이지로 이동
    • langgraph 페이지로 이동
    • 사람용 CLI와 AI 에이전트용 CLI는 설계가 다르다
    • agents.md
    • Claude Code 메모리: CLAUDE.md와 .claude/rules를 규칙으로 쓰는 법
    • Claude Code의 Skill 시스템 - 개발자를 위한 AI 자동화의 새로운 차원
    • Claude Code를 5주 더 쓴 결과 — 스킬·CLAUDE.md를 키워가는 방식
    • Claude Code를 11일 동안 쓴 결과 — 데이터로 본 나의 사용 패턴
    • Claude Code 멀티 에이전트 — Teams
    • AI 에이전트와 디자인의 새 컨벤션 — DESIGN.md, Google Stitch, Claude Design
    • Docling — IBM Research 의 문서 파싱 toolkit 상세 정리
    • 하네스 엔지니어링 실전 — 4인 에이전트 팀으로 코딩 파이프라인 구축하기
    • 하네스 엔지니어링 — 오래 실행되는 AI 에이전트를 위한 설계
    • 멀티모달 LLM (Multimodal Large Language Model)
    • AI 에이전트와 함께 MVP 만들기 — dooray-cli 사례
    • 온톨로지에서 코딩 에이전트 컨텍스트까지 — 클래스·관계 설계와 그래프 평가
    • OpenClaw는 context와 memory를 어떻게 관리하나 — 나만의 에이전트를 구성하는 법
    • OpenClaw vs Hermes Agent — 갈아탈까 고민하며 정리한 비교
  • ai 페이지로 이동
    • agent 페이지로 이동
    • [초안] AI 제품 백엔드 안정성 — 지연·비용·권한·관측·도구 실패·폴백/재시도/사람 에스컬레이션
    • [초안] LLM 평가 프레임워크: 골든셋, 회귀 테스트, LLM-as-a-judge, 사람 피드백 루프
  • algorithm 페이지로 이동
    • live-coding 페이지로 이동
    • 분산 계산을 위한 알고리즘
  • architecture 페이지로 이동
    • 시니어 백엔드를 위한 API 설계 실전 스터디 팩
    • API 버저닝과 하위 호환성: 모바일·외부 컨슈머까지 안전하게 진화시키기
    • 캐시 설계 전략 총정리
    • [초안] 커머스 Spring 서비스에 Clean/Hexagonal Architecture를 실용적으로 적용하기
    • [초안] 커머스 도메인 모델링: 주문·재고·노출의 세 축을 분리해서 설계하기
    • 커머스 주문 상태와 데이터 정합성 기본기
    • [초안] 쿠폰/프로모션 동시성과 정합성 기본기 — 선착순·중복 사용 방지·발급/사용/복구
    • [초안] DDD와 도메인 모델링: 시니어 백엔드 관점의 전술/전략 패턴 실전 가이드
    • [초안] Decorator & Chain of Responsibility — 행동을 체인으로 조립하는 두 가지 방식
    • 디자인 패턴
    • [초안] 분산 아키텍처 완전 정복: Java 백엔드 시니어 인터뷰 대비 실전 가이드
    • [초안] 분산 트랜잭션과 Outbox 패턴 — 왜 2PC를 피하고 어떻게 대신할 것인가
    • 분산 트랜잭션
    • [초안] e-Commerce 주문·결제 도메인 모델링: 상태머신, 멱등성, Outbox/Saga 실전 정리
    • [초안] Event Sourcing과 CQRS — 상태가 아니라 변화를 저장한다는 발상
    • [학습중] 금융 거래 취소·정정·대사·일마감 운영
    • [학습중] 금융 거래 상태와 원장 설계
    • [초안] F&B 쿠폰·프로모션·멤버십·포인트 설계
    • [초안] F&B · e-Commerce 디지털 채널 도메인 한 장 정리
    • [초안] F&B 주문/매장/픽업 상태머신 설계
    • [초안] F&B 이커머스 결제·환불·정산 운영 가이드
    • [초안] Hexagonal / Clean Architecture를 Spring 백엔드에 적용하기
    • [초안] 대규모 커머스 트래픽 처리 패턴 — 대규모 회원과 메가 프로모션을 버티는 설계
    • [초안] 레거시 JSP/jQuery 화면과 신규 API가 공존하는 백엔드 운영 전략
    • [학습중] 모듈러 모놀리스에서 MSA로 점진 전환하는 실습
    • [초안] MSA 서비스 간 통신: Redis [Cache-Aside](../database/redis/cache-aside.md) × Kafka 이벤트 하이브리드 설계
    • [초안] Observability 입문: 시니어 백엔드가 장애를 탐지하고 대응하는 방식
    • [초안] Outbox / Inbox Pattern 심화 — 분산 메시징의 정합성 문제를 DB 트랜잭션으로 풀어내기
    • [초안] 결제 도메인 멱등성과 트랜잭션 재시도 기본기
    • [초안] 시니어 백엔드를 위한 Resilience 패턴 실전 가이드 — Timeout, Retry, Circuit Breaker, Bulkhead, Backpressure
    • [초안] Spring Batch vs Event-Driven — 같은 비동기처럼 보이지만 전혀 다른 두 패러다임
    • [초안] Strategy Pattern — 분기문을 없애는 설계, 시니어 백엔드 인터뷰 핵심 패턴
    • [초안] 시니어 백엔드를 위한 시스템 설계 입문 스터디 팩
    • [초안] 템플릿 메서드 패턴 - 백엔드 처리 골격을 강제하는 가장 오래되고 가장 위험한 패턴
    • [초안] 대규모 트래픽 중 무중단 마이그레이션 — Feature Flag + Shadow Mode 실전
  • database 페이지로 이동
    • milvus 페이지로 이동
    • mysql 페이지로 이동
    • opensearch 페이지로 이동
    • qdrant 페이지로 이동
    • redis 페이지로 이동
    • vespa 페이지로 이동
    • 김영한의-실전-데이터베이스-설계 페이지로 이동
    • [초안] DB Connection Pool Saturation과 Thread Pool 격리
    • 커넥션 풀 크기는 얼마나 조정해야 할까?
    • 인덱스 - DB 성능 최적화의 핵심
    • [초안] JPA N+1과 커머스 조회 모델: 주문/메뉴/쿠폰 도메인에서 살아남기
    • [초안] MyBatis 기본기 — XML Mapper, resultMap, 동적 SQL, 운영 패턴 정리
    • [초안] MyBatis와 JPA/Hibernate 트레이드오프 — 레거시 백엔드를 다루는 시니어 관점
    • 한국어 형태소 분석기 Nori vs Lindera — OpenSearch에서 Milvus로 갈 때 어휘 검색은 유지되나
    • 벡터 DB 5종, 아키텍처는 어떻게 다른가
    • 벡터 DB 5종을 실제로 벤치마크했다 — 같은 recall에서 QPS는 얼마나 갈리나
    • 벡터 DB 어떻게 고를까 — OpenSearch · Milvus · Qdrant · Vespa · pgvector 비교
    • 벡터 DB를 실제로 도입한 사례 — 빅테크 프로덕션
    • 역정규화 (Denormalization)
    • 데이터 베이스 정규화
  • devops 페이지로 이동
    • docker 페이지로 이동
    • k8s 페이지로 이동
    • k8s-in-action 페이지로 이동
    • observability 페이지로 이동
    • [초안] 커머스/F&B 채널 장애 첫 5분과 관측성 기본기
    • [초안] 운영 데이터 정합성 장애 대응 — 결제 취소 누락과 중복 적재 런북
    • Envoy Proxy
    • [초안] F&B / e-Commerce 운영 장애 대응과 모니터링 — 백엔드 관점 정리
    • Graceful Shutdown
    • [초안] 시니어 백엔드를 위한 SLO와 Error Budget 기반 장애 대응
  • http 페이지로 이동
    • HTTP Connection Pool
    • HTTPS는 어떻게 안전한가 — TLS, 인증서, 그리고 termination
  • interview 페이지로 이동
    • [초안] AI 서비스 팀 경험 기반 시니어 백엔드 면접 질문 뱅크 — Spring Batch RAG / gRPC graceful shutdown / 캐시 정합성 / 12일 AI 웹툰 MVP
    • Observability — 면접 답변 프레임
    • [초안] 시니어 Java 백엔드 면접 마스터 플레이북 — 김병태
    • [초안] NSC 슬롯팀 경험 기반 질문 은행 — 도메인 모델링·동시성·성능·AI 협업
  • java 페이지로 이동
    • concurrency 페이지로 이동
    • jdbc 페이지로 이동
    • opentelemetry 페이지로 이동
    • spring 페이지로 이동
    • spring-batch 페이지로 이동
    • testing 페이지로 이동
    • 더_자바_코드를_조작하는_다양한_방법 페이지로 이동
    • [초안] Java 동시성 락 정리 — 커머스 메뉴/프로모션 정책 캐시 갱신 관점
    • [초안] JVM 튜닝 실전: 메모리 구조부터 Virtual Threads, GC 튜닝, 프로파일링까지
    • Java의 로깅 환경
    • MDC (Mapped Diagnostic Context)
    • Java StampedLock — 읽기 폭주에도 쓰기가 밀리지 않는 락
    • Virtual Thread와 Project Loom
  • javascript 페이지로 이동
    • typescript 페이지로 이동
    • AbortController
    • Async Iterator와 제너레이터
    • CommonJS와 ECMAScript Modules
    • 제너레이터(Generator)
    • Http Client
    • Node 백엔드 운영 패턴 — Streams 백프레셔, pipe/pipeline, 멱등성 vs 분산 락
    • Node.js
    • npm vs pnpm — 어떤 기준으로 선택했나
    • `setImmediate()`
  • kafka 페이지로 이동
    • [초안] Kafka 기본 개념 — 토픽, 파티션, 오프셋, 복제
    • Kafka를 사용하여 **데이터 정합성**은 어떻게 유지해야 할까?
    • [초안] Kafka 실전 설계: 파티션 전략, 컨슈머 그룹, 전달 보장, 재시도, 순서 보장 트레이드오프
    • [학습중] Kafka 파티션·리밸런스·컨슈머 지연 운영
    • 메시지 전송 신뢰성
    • [초안] Spring Kafka 컨슈머 오프셋 커밋과 트랜잭션 정렬: AckMode, manual ack, 멱등 처리
  • linux 페이지로 이동
    • fsync — 리눅스 파일 동기화 시스템 콜
    • tmux — Terminal Multiplexer
  • mlops 페이지로 이동
    • llm-serving 페이지로 이동
    • serving-frameworks 페이지로 이동
    • Python CUDA 버전 생태계 — nvidia-smi, nvcc, pip, conda가 다 다른 버전을 말하는 이유
    • GPU 컨테이너의 CUDA 버전 호환성 — nvidia-smi부터 이미지 다이어트까지
    • Kubernetes GPU 노드에서 /run tmpfs가 꽉 차서 Pod가 안 뜰 때
    • GPU·CUDA·MPS 기초 — 자바 백엔드 개발자가 처음 만나는 그림
    • Multi-process GPU 워크로드 — 자바 ThreadPool 사용자가 만나는 모델 차이
    • ML 서비스 성능 분석 워크플로 — 자바 백엔드 트러블슈팅과 다른 점
    • 한 GPU 를 여러 프로세스가 나눠 쓰기 — Time-Slicing 과 MPS
  • network 페이지로 이동
    • Connection reset by peer는 누가 보낸 걸까 — 리버스 프록시 홉마다 TCP 연결은 따로 논다
    • L2(스위치)와 L3(라우터)의 역할 차이
    • L4와 VIP(Virtual IP Address)
    • IP Subnet
  • python 페이지로 이동
    • Python async/await — CompletableFuture·Reactor 와 다른 점, 그리고 blocking I/O 함정
    • Python 의존성 관리 — Java Maven/Gradle 사용자가 만나는 첫 충격
    • FastAPI 기초 — Spring Boot 사용자가 빠르게 익히는 법
    • Java 개발자를 위한 Python 심화 — OOP·데코레이터·컨텍스트 매니저
    • PyTorch 기초 — 텐서, 디바이스, 그리고 모델 로딩이 무거운 이유
    • Java 개발자를 위한 Python 문법 핵심
    • ThreadLocal 에서 contextvars 로 — Python 의 요청 컨텍스트 전파
    • OCR 동작 원리 — Layout · Text · Post-process 3단계
    • Python 서버의 RSS 가 안 줄어드는 이유 — gc.collect 의 한계와 malloc_trim
  • rabbitmq 페이지로 이동
    • [초안] RabbitMQ Basics — 실전 백엔드 관점에서 정리하는 메시지 브로커 기본기
    • [초안] RabbitMQ vs Kafka — 백엔드 메시징 선택 기준과 실전 운영 관점
  • resume 페이지로 이동
    • [초안] 김병태 경력기술서
    • [초안] 김병태 포트폴리오
  • security 페이지로 이동
    • [초안] 시니어 백엔드를 위한 보안 / 인증 스터디 팩 — Spring Security, JWT, OAuth2, OWASP Top 10
    • [초안] Spring Security 6.x OAuth2 + JWT 상용 인증 설계 — Grant 선택, Resource Server, Refresh Rotation, 로그아웃
  • task 페이지로 이동
    • ai-service-team 페이지로 이동
    • nsc-slot 페이지로 이동
    • sb-dev-team 페이지로 이동
    • the-future-company 페이지로 이동
  • testing 페이지로 이동
    • [초안] 시니어 Java 백엔드를 위한 테스트 전략 완전 정리 — 피라미드부터 TestContainers, 마이크로벤치, Contract까지
  • thinking 페이지로 이동
    • 좋은 일을 넘어 중요한 일을 하는 법
FOS-BLOG · FOOTERall systems normal·v0.1 · 2026.04.27·seoul, kr
Ffos-blog/study

개발 학습 기록을 정리하는 블로그입니다. 공부하면서 기록하고, 기록하면서 다시 배웁니다.

visitors
01site
  • Home↗
  • Posts↗
  • Categories↗
  • Glossary↗
  • About↗
02policy
  • 소개/about
  • 개인정보처리방침/privacy
  • 연락처/contact
03categories
  • AI↗
  • Algorithm↗
  • DB↗
  • DevOps↗
  • Java/Spring↗
  • JS/TS↗
  • React↗
  • Next.js↗
  • System↗
04connect
  • GitHub@jon890↗
  • Source repositoryjon890/fos-study↗
  • RSS feed/rss.xml↗
  • Newsletter매주 1 회 · 한 편의 글→
© 2026 FOS Study. All posts MIT-licensed.
built with·Next.js·Tailwind v4·Geist·Pretendard·oklch
/fos-blog/categories/AI/RAG/neo4j-graphrag

AI · RAG · NEO4J-GRAPHRAG

neo4j-graphrag

8글·category/AI/RAG/neo4j-graphrag

READMEneo4j-graphrag 시리즈에 대하여

README.md
README.md

이 시리즈의 목표는 지식 그래프를 많이 만드는 것이 아니다. 에이전트가 지식 사이의 관계를 탐색하고, 마지막에는 답을 뒷받침하는 원문 문서까지 돌아갈 수 있는 검색 도구를 만드는 것이다.

그래프의 성공은 노드 수나 관계 수로 판단하지 않는다. 벡터 검색만으로 놓치던 관계형 질문에서 더 나은 근거를 찾고, 권한·최신성·출처 조건을 지킨 컨텍스트를 제공할 때 가치가 생긴다.

이 시리즈는 다음 세 질문을 따라간다.

  • 온톨로지의 개념을 Neo4j 속성 그래프에 어떻게 옮길 것인가?
  • 벡터 검색과 관계 탐색을 어떤 순서로 결합할 것인가?
  • GraphRAG가 실제로 더 나은 컨텍스트를 만들었는지 어떻게 증명할 것인가?

먼저 읽으면 좋은 글은 두 편이다.

  • 온톨로지에서 코딩 에이전트 컨텍스트까지
    • 클래스, 개체 동일성, 주장과 근거를 어떤 계약으로 다룰지 설명한다.
  • RAG를 평가에서 역설계하기
    • 검색 결과가 아니라 컨텍스트 제공자 전체를 어떻게 평가할지 설명한다.

만들려는 시스템

원천 문서는 그래프에 흡수되어 사라지지 않는다. 그래프는 원문으로 가는 탐색 경로와 의미 계약을 제공하고, 최종 근거는 항상 문서와 청크를 가리킨다.

이 구조에서 Neo4j는 세 역할을 맡는다.

  • 질문과 가까운 문서·청크·개체 후보를 찾는다.
  • 후보에서 소유권, 의존성, 결정, 장애, 근거 관계를 확장한다.
  • 관계 경로를 최종 원문과 연결해 출처를 잃지 않게 한다.

공통 실습 도메인

모든 글은 일반화한 사내 기술 지식 기반을 사용한다. 실제 회사명, 서비스명, 저장소명은 사용하지 않는다.

노드역할대표 식별자
Service운영되는 서비스service_id
API서비스가 제공하거나 호출하는 APIapi_id
Repository구현 소스가 있는 저장소repository_id
ADR기술 결정과 대안adr_id
Owner담당 조직 또는 역할owner_id
Incident장애와 영향incident_id
Claim문서에서 추출한 검증 가능한 주장claim_id
Evidence주장을 뒷받침하는 원문 구간evidence_id
Document원본 문서document_id, source_uri
Chunk검색과 인용을 위한 문서 구간chunk_id

대표 식별자는 병합과 참조에 쓰는 안정적인 키다. Service.name, API.path, Repository.name 같은 표시 속성은 정확한 이름 검색과 전문 검색에 쓰되, 노드 정체성을 대신하지 않는다. 모든 노드는 대표 식별자에 고유성 제약을 두고 표시 속성은 별도 인덱스로 관리한다.

관계는 질문에 답하기 위해 만든다.

Claim과 Evidence를 분리하는 이유가 중요하다. 그래프의 관계가 맞는 것처럼 보여도, 그 관계를 뒷받침하는 원문이 없으면 에이전트에 제공할 근거로 사용할 수 없다.

공식 KG Builder의 어휘 그래프 기본값은 Chunk-[:FROM_DOCUMENT]->Document와 Chunk.id다. 이 시리즈는 모든 실습에서 LexicalGraphConfig를 명시해 Chunk-[:PART_OF]->Document와 Chunk.chunk_id로 통일한다. 추출된 개체에서 청크로 향하는 기본 출처 관계는 MENTIONED_IN으로 기록하고, Claim -> Evidence -> Chunk 경로는 적재 후 검증 단계에서 별도로 만든다.

공통 ACL 계약

권한 관련 속성은 같은 역할을 하지 않는다.

필드저장 위치역할
allowed_groupsDocument원본 문서의 권한 원천이다
acl_partitionChunk단일 권한 범위를 재현하는 벡터 선필터 실습용 속성이다
allowed_source_uris요청 계약출력 직전 원문 접근 권한을 다시 확인한다
접근 범위별 인덱스·데이터베이스검색 경계하이브리드 검색에서 후보 생성 전 권한을 강제한다

allowed_groups 같은 복수 그룹 목록을 acl_partition과 같은 단일 필터 속성으로 보지 않는다. 복잡한 문서별 ACL은 접근 범위별 검색 공간, Neo4j 권한, 사용자 정의 검색기 중 하나로 후보 단계부터 제한해야 한다.

시리즈 순서

순서글읽고 나면 할 수 있는 것
시작Neo4j GraphRAG의 목표와 기준선관계형 질문과 평가 기준선을 정의한다
모델속성 그래프와 온톨로지 모델링질문에서 노드·관계·식별 계약을 역설계한다
질의Cypher, 제약, 쿼리 계획으로 검색 안정화하기관계 탐색 쿼리와 무결성·성능 경계를 검증한다
적재문서에서 근거를 보존한 지식 그래프 구축하기추출·저장·개체 식별 파이프라인을 분해한다
검색벡터·전문·그래프 탐색을 결합한 하이브리드 검색질문 유형에 맞춰 검색 경로를 선택한다
제공에이전트를 위한 Neo4j 컨텍스트 제공자 설계읽기 전용 검색 도구의 입출력과 안전 경계를 정의한다
평가GraphRAG 평가와 벡터 RAG 제거 실험그래프 구축·검색·컨텍스트·답변 품질을 따로 측정한다
운영권한·최신성·성능을 포함한 Neo4j 운영 설계학습용 구성과 사내 운영 구성을 구분한다

각 글은 앞 글의 산출물을 다음 글의 입력으로 사용한다. 중간 글만 골라 읽을 수는 있지만, 실습은 위 순서대로 진행해야 평가 기준이 흔들리지 않는다.

공통 질문 세트

실습 질문은 단일 문서 검색만으로 끝나는 질문과 관계 탐색이 필요한 질문을 섞는다.

단일 근거 질문

  • 특정 API의 제한 시간은 얼마인가?
  • 특정 ADR이 채택한 저장 방식은 무엇인가?

관계 탐색 질문

  • 이 API를 변경하면 어떤 서비스와 저장소를 함께 검토해야 하는가?
  • 최근 장애와 관련된 기술 결정은 무엇이며 담당자는 누구인가?
  • 같은 서비스에 대해 서로 충돌하는 운영 문서가 있는가?

안전 경계 질문

  • 현재 사용자가 볼 수 없는 문서를 제외하고 근거를 제시할 수 있는가?
  • 폐기된 ADR보다 최신 결정을 우선할 수 있는가?
  • 답을 만들 수 없을 때 근거 부족으로 중단할 수 있는가?

관계형 질문이 있다고 해서 GraphRAG가 자동으로 유리한 것은 아니다. 관계 추출이 부정확하거나 원문 연결이 끊기면, 그래프 탐색은 벡터 검색보다 더 그럴듯한 오답을 만들 수 있다.

공통 평가표

계층확인할 항목실패로 보는 조건
그래프 구축개체 식별, 관계 정확성, 원문 연결잘못 합쳐진 개체나 근거 없는 관계가 생긴다
후보 검색필수 문서와 증거 회수필요한 근거가 후보에 들어오지 않는다
관계 탐색필요한 경로 회수, 경로 길이와 잡음무관한 고차 관계가 컨텍스트를 채운다
컨텍스트 조립출처, 최신성, 토큰 예산후보에 있던 근거가 최종 입력에서 빠진다
안전접근 권한, 읽기 전용, 시간 제한권한 밖 문서나 쓰기 쿼리가 실행된다
최종 답변근거 충실성, 인용 정확성, 무응답원문이 지지하지 않는 답을 만든다
운영지연, 비용, 실패율품질을 얻었지만 서비스 예산을 넘는다

절대적인 목표 수치는 데이터와 서비스 예산을 보고 정한다. 처음에는 다음 불변 조건부터 고정한다.

  • 권한 위반은 허용하지 않는다.
  • 근거로 사용한 관계는 최종 원문을 가리켜야 한다.
  • 최신성을 판정할 수 없는 근거는 상태를 명시한다.
  • 그래프를 추가한 구성은 같은 질문 세트의 벡터 RAG 기준선과 비교한다.

실습 환경과 버전 경계

학습 구현은 Python과 공식 neo4j-graphrag 패키지를 중심으로 한다. 로컬에서는 Neo4j Community Edition 또는 임시 AuraDB 인스턴스로 시작할 수 있다.

현재 공식 문서에서 확인해야 할 버전 경계가 있다.

  • neo4j-graphrag는 과거 neo4j-genai 패키지의 후속 패키지다.
  • 지식 그래프 구축 파이프라인은 아직 실험 기능이므로 API 변경 가능성을 전제로 둔다.
  • 현재 공식 하이브리드 검색기는 사전 필터를 지원하지 않으므로, 문서 ACL은 접근 범위별 검색 공간·Neo4j 권한·사용자 정의 검색기 중 하나로 후보 생성 전에 적용한다.
  • 최신 Neo4j는 달력 버전과 Cypher 버전을 분리하므로 예제의 서버·Cypher 버전을 함께 기록한다.
  • 벡터 인덱스 질의 방식은 서버 버전에 따라 SEARCH 절 또는 프로시저를 사용한다.
  • 역할 기반 권한, 하위 그래프 접근 제어, 다중 데이터베이스, 온라인 백업은 에디션과 배포 방식에 따라 지원 범위가 다르다.

따라서 글의 코드를 복사하는 것보다, 현재 설치한 버전의 공식 문서에서 지원 범위를 다시 확인하는 습관이 더 중요하다.

이 시리즈에서 뒤로 미루는 것

다음 기술은 필요할 때만 선택한다.

  • RDF·OWL·SHACL 연동이 필요할 때 neosemantics를 검토한다.
  • 커뮤니티 탐지나 그래프 임베딩이 평가 질문에 필요할 때 GDS를 검토한다.
  • 복잡한 적재·변환을 Cypher만으로 다루기 어려울 때 APOC Core를 검토한다.
  • 자유 형식 질문을 Cypher로 바꾸는 가치가 확인된 뒤에만 Text2Cypher를 연다.

기본 검색 경로를 검증하기 전에 선택 기능부터 붙이면, 어느 구성요소가 품질을 바꿨는지 알 수 없게 된다.

참고 링크

  • Neo4j GraphRAG for Python: https://neo4j.com/docs/neo4j-graphrag-python/current/
  • Neo4j GraphRAG RAG guide: https://neo4j.com/docs/neo4j-graphrag-python/current/user_guide_rag.html
  • Neo4j GraphRAG Knowledge Graph Builder: https://neo4j.com/docs/neo4j-graphrag-python/current/user_guide_kg_builder.html
  • Neo4j data modeling: https://neo4j.com/docs/getting-started/data-modeling/
  • Neo4j Cypher Manual: https://neo4j.com/docs/cypher-manual/current/
  • Neo4j Operations Manual: https://neo4j.com/docs/operations-manual/current/
  • Neo4j editions: https://neo4j.com/docs/operations-manual/current/introduction/
  • Neo4j GraphAcademy courses: https://graphacademy.neo4j.com/courses/

02이 폴더의 글

8 posts
— 001

Cypher, 제약, 쿼리 계획으로 검색 안정화하기

GraphRAG에서 Cypher는 그래프를 읽는 문법이 아니라 컨텍스트 제공자의 품질 장치다. 제약은 중복과 결측을 막고, 인덱스와 실행 계획은 관계 탐색이 어디서 터지는지 드러낸다. > 이전 글: 속성 그래프와 온톨로지 모델링 이 글은 Neo4j 2026 계열과 Cypher 25 문서를 기준으로 쓴다. 특히 벡터 인덱스 조회는 Neo4j 2026.01부터...

—
—
— 002

GraphRAG 평가와 벡터 RAG 제거 실험

GraphRAG 평가는 "답이 맞았다" 하나로 끝나면 안 된다. 이 글의 결론은, 그래프 구축 품질, 후보와 근거 회수, 최종 컨텍스트 정밀도와 재현율, 출처·최신성·권한·지연·비용을 단계별로 나누고, 반드시 벡터 전용 기준선과 제거 실험으로 비교해야 한다는 것이다. 그래프를 만들었다는 사실은 성공 기준이 아니다. 벡터 RAG가 놓친 관계형 질문에서, 권한...

—
—
— 003

Neo4j GraphRAG의 목표와 기준선

Neo4j GraphRAG를 공부하는 목표는 그래프를 예쁘게 만드는 것이 아니다. 관계형 질문에서 벡터 RAG가 놓친 근거를 권한과 출처를 보존한 컨텍스트로 제공하는 것이다. RAG를 평가에서 역설계하기를 먼저 읽으면 좋다. 이 글은 그 평가 관점을 Neo4j GraphRAG 학습 프로젝트의 기준선으로 옮긴다. 핵심 질문은 세 가지다. - 어떤 질문은 벡터...

—
—
— 004

권한·최신성·성능을 포함한 Neo4j 운영 설계

운영 설계의 결론은 학습 환경과 제품 환경을 분리하는 것이다. Neo4j Community Edition은 로컬 학습과 단일 인스턴스 실습에 충분할 수 있지만, 사내 컨텍스트 제공자가 권한, 가용성, 백업, 운영 보안을 요구하면 Enterprise 또는 Aura 기능 범위를 따로 검토해야 한다. Text2Cypher는 특히 조심해야 한다. 읽기 전용 권한,...

—
—
— 005

문서에서 근거를 보존한 지식 그래프 구축하기

Neo4j GraphRAG Python의 KG Builder는 문서를 그래프로 만드는 출발점이지만, 아직 실험적 기능이다. 그래서 이 글의 목표는 패키지를 믿고 맡기는 것이 아니라, 어떤 단계에서 어떤 품질 게이트를 끼워 넣을지 읽는 것이다. > 이전 글: Cypher, 제약, 쿼리 계획으로 검색 안정화하기 Neo4j GraphRAG Python 문서는 n...

—
—
— 006

벡터·전문·그래프 탐색을 결합한 하이브리드 검색

벡터 검색만으로 놓치는 질문은 대부분 "가까운 문장"이 아니라 "연결된 사실"을 요구한다. 이 글의 결론은 단순하다. Neo4j GraphRAG의 하이브리드 검색은 벡터와 전문 검색으로 후보를 넓히고, VectorCypherRetriever나 HybridCypherRetriever로 관계를 확장한 뒤, 최종 컨텍스트는 반드시 원문 Document와 Chun...

—
—
— 007

속성 그래프와 온톨로지 모델링

Neo4j 모델링은 명사를 라벨로 옮기는 작업이 아니다. 컨텍스트 제공자가 답해야 할 질문을 먼저 고르고, 그 질문에 필요한 경로만 속성 그래프로 고정하는 작업이다. > 이전 글: Neo4j GraphRAG의 목표와 기준선 온톨로지에서 코딩 에이전트 컨텍스트까지를 먼저 읽으면 좋다. 이 글은 그 온톨로지 관점을 Neo4j 속성 그래프에 맞춰 줄이는 단계다....

—
—
— 008

에이전트를 위한 Neo4j 컨텍스트 제공자 설계

컨텍스트 제공자는 검색기를 감싼 얇은 함수가 아니다. 이 글의 결론은, 사내 에이전트에 붙이는 Neo4j 컨텍스트 제공자는 읽기 전용 도구이며 ACL 선필터, 출처, 최신성, 토큰 예산, 시간 제한, 출력 계약을 함께 보장해야 한다는 것이다. 그래프 탐색은 유용하지만 위험도 크다. 관계 경로가 답처럼 보일수록, 그 경로를 누가 볼 수 있고 어떤 원문이 지지...

—
—