콘텐츠로 이동

03-실전

03. 실전 — Claude Code / OMC에서 RAG처럼 일하기

섹션 제목: “03. 실전 — Claude Code / OMC에서 RAG처럼 일하기”

Claude Code의 Grep(ripgrep)으로 좁히고, 매칭이 있는 파일만 Read offset/limit으로 부분 읽기. “전체 파일 다 읽기” 는 마지막 수단.

OMC explore 에이전트는 haiku로 빠르게 코드베이스를 매핑하고 부모에는 요약만 돌려준다. 부모 컨텍스트가 깨끗하게 유지된다 — Context Quarantine의 1인분.

OMC의 team N:writer 같은 모드는 워커별로 도구 세트를 좁힌다. writer 워커는 검색·읽기·쓰기 정도만, executor 워커는 추가로 빌드·테스트. 한 워커에 모든 도구를 노출하지 않는다.

패턴 4. 결과 요약 후 인라인 금지

섹션 제목: “패턴 4. 결과 요약 후 인라인 금지”

도구 결과가 길면 그 결과를 다시 모델로 한 번 더 보내 요약하게 한 뒤 그 요약만 부모 컨텍스트에 넣는다. 멀티 에이전트 권장처럼 “파일 시스템에 저장” 도 한 가지 답.

작은 평가 세트(쿼리 30~50개, 정답 문서)를 만든다. 매주 Recall@5/Precision@5를 측정. 0.7 미만이면 검색을 먼저 고친다 — 생성 품질을 먼저 고치지 않는다(Hamel 원칙).

  1. 모델이 잘못된 답을 했다.
  2. 검색 결과에 정답이 있었나? — 없으면 → 검색을 고친다(인덱스, 청크, 임베딩, BM25 가중).
  3. 있었나? → 생성을 고친다(프롬프트, 형식, 예시).
  4. 컨텍스트에 무관한 도구·정보가 있는가? → Tool Loadout / Pruning.
  5. 그래도 안 되면 Context Quarantine 으로 서브에이전트 분리.

사내 Confluence/Notion + 코드 모노레포가 같이 있는 환경이라면: 코드는 Grep, 문서는 임베딩, 결정 로그는 notepad.md. 셋을 한 컨텍스트에 다 펼치지 말고 작업이 시작될 때 필요한 것만 부른다.