Files
2nd/10_Wiki/Topics/Domain_Programming/Topic_Programming/RAG_Pattern.md
T
Antigravity Agent c24165b8bc refactor(topics): 멀티 에이전트용 지식 재편 — _Common(공통 기본기) + Domain_* 구조
에이전트 8종(대화형/프로그래머 C·S/디자이너/설계자/기획자/QA/PD/PM)에게
[공통 기본 능력 + 롤별 Specialty] 2층으로 지식을 주입하기 위한 재분류.
문서 내용·포맷은 무수정, 폴더 이동만 (6,372개 문서 수 보존 확인).

- Topic_Programming → Domain_Programming (내부 구조 보존)
- Topic_Graphic → Domain_Design
- Topic_Business → Domain_Product
- Topic_General → Domain_General
- _Common 신설: Math(구 Topic_Math_Specialty), Reasoning(구 General/From_Thinking & Reasoning),
  Reasoning_Creativity(구 General/From_창의성), Communication(Poetic_Blog_Writing + From_writing)
- 타 도메인의 From_* 폴더는 유지 (출처 표기일 뿐, 이미 도메인에 맞게 분류된 문서)
- 빈 폴더 정리 (memory/procedures)
- 에이전트→폴더 매핑은 workspace의 .astra/agent-knowledge-map.json (9개 에이전트)

Co-Authored-By: Claude Fable 5 <noreply@anthropic.com>
2026-07-11 11:05:56 +09:00

3.5 KiB

id, title, category, status, verification_status, canonical_id, aliases, duplicate_of, source_trust_level, confidence_score, created_at, updated_at, review_reason, merge_history, tags, raw_sources, applied_in, github_commit
id title category status verification_status canonical_id aliases duplicate_of source_trust_level confidence_score created_at updated_at review_reason merge_history tags raw_sources applied_in github_commit
pattern-rag RAG Pattern Pattern_AI draft applied
RAG
Retrieval-Augmented Generation
검색 증강 생성 패턴
A 0.9 2026-06-13 2026-06-13
pattern
ai
rag
retrieval
platform-independent
일반 소프트웨어 공학 지식
ConnectAI/src/retrieval/* (적용 예)
ConnectAI

RAG Pattern

🎯 한 줄 통찰 (One-line insight)

RAG 는 "모델이 답하기 전에 외부 지식에서 관련 조각을 검색해 프롬프트에 주입" 하는 패턴으로, 모델의 학습되지 않은/최신/사적 지식을 재학습 없이 활용하고 환각을 줄인다.

🧠 핵심 개념 (Core concepts)

  1. 인덱싱: 문서를 청크로 나눠 검색 인덱스(키워드/임베딩)에 저장.
  2. 검색: 질의로 top-k 관련 청크 회수(sparse/dense/하이브리드).
  3. 증강: 회수 청크를 컨텍스트로 프롬프트에 삽입(토큰 예산 내).
  4. 생성: 모델이 근거를 보고 답하고 출처를 인용.

📖 세부 내용 (Details · 패턴 명세)

  • Problem (언제 쓰나): 모델이 모르는 사적/최신/대용량 지식이 필요하고, 파인튜닝은 비싸거나 자주 바뀔 때. 출처 인용·환각 감소가 필요할 때.
  • 사용 조건: 검색 가능한 지식 베이스 존재; 청킹/인덱싱 가능; 컨텍스트 한도 내 주입 가능.
  • 장점: 재학습 불필요, 지식 즉시 갱신, 출처 추적, 환각↓, 작은 모델도 강화.
  • 단점: 검색 품질에 답이 좌우(garbage in), 인덱싱/저장 비용, 컨텍스트 토큰 소비, 청킹 경계 손실.
  • 대안: 파인튜닝(지식이 안정적·대규모일 때), 긴 컨텍스트에 전체 투입(소량일 때), 도구 호출로 실시간 조회.
  • 실패 사례: 청크가 너무 커 정밀도↓; 부분 정규화로 하이브리드 편향; 동의어 미확장으로 recall↓; stale 인덱스; 운영 로그를 지식으로 오염.

💻 코드 패턴 (Code patterns)

index   = chunk(docs) -> tokenize/embed -> store
query   -> expand(synonyms) -> score(sparse + α·dense) -> normalize -> rerank
context = selectWithinTokenBudget(top_chunks)
answer  = LLM(system + context + question)  # "근거 없으면 모른다고"

적용 예: ConnectAI 의 RAG 검색 파이프라인·TF-IDF 이중언어 스코어링 (하이브리드+섹션 청킹+토큰 예산).

⚖️ 모순 및 업데이트 (Contradictions & updates)

"임베딩만 쓰면 된다" 는 가용성·설명가능성을 잃는다 — 결정론(키워드) 바닥선 + 임베딩 가산이 견고(ADR-0007 하이브리드 검색 결정론 우선).

🛠️ 적용 사례 (Applied in summary)

ConnectAI 전체 검색이 이 패턴. → AITRAIN RAG 검색.

🔗 지식 그래프 (Knowledge Graph)

📚 출처 (Sources)

  • [S1] 일반 RAG 공학 지식
  • [S2] ConnectAI/src/retrieval/* — 적용 예

📝 변경 이력 (Change history)

  • 2026-06-13: 프로젝트 독립 패턴 카드 작성.