ELI5 · 쉬운 설명
agent-trace — 에이전트의 블랙박스를 읽어
교본에 한 줄 적어 넣는 도구
마지막 업데이트 2026-09-18
Claude Code, Codex, Hermes가 일하면서 남긴 기록을 모아, 어느 턴에서 헛돌았는지 찾고, 그 교훈을 CLAUDE.md / AGENTS.md에 한 줄로 되돌려 넣습니다. 그림 7장으로 설명합니다.
2026-09-18저장소 ~/git-projects/agent-trace실행 절차·명령은 실행 가이드
한 장 요약. 에이전트가 운전자라면 agent-trace는 블랙박스 영상을 모아 위험 구간을 찍어 주고, 반복되는 실수를 운전 교본에 적어 넣는 안전관리자입니다. 운전에 끼어들지 않고, 영상을 고치지 않고, 밖으로 보내지 않습니다.
그림 1전체 그림 — 기록에서 교본까지
왼쪽에서 오른쪽으로 한 번 흐르고, 마지막에 다시 왼쪽으로 돌아옵니다.
agent-trace는 에이전트 옆에 서 있지 않습니다. 에이전트가 떠난 뒤 남은 기록을 읽습니다.
그림 2어디서 읽나 — 미들웨어가 아닙니다
에이전트는 agent-trace가 있는지도 모릅니다. 원래 남기던 파일을 나중에 읽을 뿐입니다.
그림 3번역 — 세 가지 모양을 하나로
도구마다 기록 형식이 다릅니다. 도구별 통역사(파서)가 같은 모양으로 바꿔 줍니다.
"턴"이 기준 단위입니다. Claude Code 턴과 Codex 턴을 같은 표에 놓고 비교할 수 있게 됩니다.
그림 4저장과 화면 — 정본 하나, 뷰어 하나
SQLite가 정본입니다. Phoenix는 그것을 보여 주는 별도 프로그램(Docker 컨테이너)입니다.
라이브러리로 내장한 것이 아니라 네트워크로 통신하는 별도 프로그램입니다. 자세한 화면 사용법은 Phoenix 사용법.
그림 5문제 턴 — 룰 7개가 후보를 찍습니다
"확실히 나쁜 턴"이 아니라 "볼 가치가 있는 턴"을 넓게 잡습니다. 진짜 판정은 다음 단계에서.
🐢 느린 턴
같은 도구 평소보다 훨씬 오래 걸림 (p95 초과)
오탐 많음 — 툴·사람 대기 포함
🔁 같은 툴 반복
같은 명령을 3번 이상 똑같이 실행
루프 의심
💥 툴 에러 잦음
툴 호출 중 40% 이상 실패
시행착오
🙅 사용자가 고침
다음 말이 "아니", "다시", "왜"로 시작
가장 확실한 신호
🧹 기억 압축 직후
컨텍스트가 요약된 바로 다음 턴
위치 정보일 뿐
⛔ 중단됨
턴이 끝나기 전에 멈춤
Codex만 감지
🤔 생각만 많음
thinking 토큰이 답의 10배 초과
과잉 추론
왜 룰이 먼저인가. 룰은 공짜고 3,000턴을 몇 초에 훑습니다. LLM은 비싸서 룰이 찍은 턴만 봅니다. "사용자가 고침"은 사람이 이미 라벨을 붙여 준 것과 같아서 가장 값진 신호입니다.
그림 6판정과 환류 — 교본에 한 줄이 들어가기까지
네 명령이 이어지고, 마지막은 반드시 사람이 승인합니다.
①은 자동으로 돌 수도 있지만, ②③④는 지금 사람이 명령을 실행합니다. ④는 설계상 자동화하지 않습니다.
지금 위치. 표시 239건 중 판정은 6건, 교본에 들어간 규칙은 0건입니다. 판정 6건의 심각도가 전부 0~1이라 묶일 제안이 아직 없습니다. 루프는 완성되어 있지만 재료가 덜 쌓였습니다.
그림 7서브에이전트 — 부모 턴 안에 자식 턴
에이전트가 다른 에이전트를 부르면, 그 대화도 따로 기록되고 부모 턴 아래에 붙습니다.
오늘숫자로 한눈에 — 2026-09-18
814세션
5,554턴
33,698툴 호출
239문제 턴 표시
6LLM 판정
0교본에 들어간 규칙
SQLite 254MB · watch가 launchd로 상시 실행 중 · 이 문서를 만든 대화도 이미 들어가 있음