블로그
hiway-kit을 만들며 겪은 사례 기록입니다. 무엇이 깨졌고, 어떻게 찾았고, 지금 킷은 어떻게 다루는지. 각 글은 현행 킷과 대조해 갱신했고, 이후 바뀐 것을 글 끝에 적었습니다.
마지막 태스크는 끝나지 않는다: 턴 경계에서 증발하는 완료 마킹, 그리고 3중 방어
작업이 끝나도 마지막 태스크가 in_progress로 남는 버그를 추적했다. 범인은 지시 순서 한 줄이었고, 규율·기계 감지·감지기의 보안까지 3중 방어를 쌓은 과정과 그 뒤에 바뀐 것을 기록한다.
초록불은 거짓말을 한다: 내가 만든 완료 게이트를 6방향 적대적 감사로 뜯어본 기록
완료 게이트가 초록불을 켰는데, 6개의 fresh-context 적대적 리뷰어를 프로젝트 전체에 풀자 바로 그 게이트들이 실패를 초록불로 보고하고 있었다. 검증 기계 자체를 검증한 기록, 그리고 '작성자는 오염돼 있다'가 왜 게이트를 짠 나에게 가장 아프게 적용되는지.
완료를 주장이 아니라 명령의 출력으로: 장기 루프 에이전트의 durable 완료 게이트를 설계한 기록
루프 에이전트가 스스로 '완료'를 찍게 두면 검증되지 않은 코드가 완료로 통과한다. 네이티브 Task가 세션 스코프라는 발견이 첫 설계를 폐기시킨 과정, 그리고 완료 상태를 파일 하나와 verify 명령의 raw exit-code로 옮겨 기계가 판정하게 만든 기록.
하네스를 실전에 적용하다: 병렬 에이전트 툴킷의 git 격리를 두 번의 적대적 리뷰로 다듬은 기록
'Agent = Model + Harness' 이론을 실제 Claude Code 툴킷에 적용한 케이스 스터디. 병렬 작업의 레이스 컨디션을 잡고, 두 번째 적대적 리뷰가 첫 리뷰에서 놓친 검증 우회를 어떻게 찾아냈는지 기록한다.