두 한계를 하루에 없앴다고 적었다
2026년 8월 1일 커밋 메시지에 저는 "두 한계 해결"이라고 썼습니다. 첫 번째 한계는 콘텐츠가 유한하다는 것, 두 번째는 사람이 아무도 보지 않는 채로 게시가 나간다는 것이었습니다. 한 커밋에 241줄을 더하고 둘 다 지웠다고 선언했습니다.
첫 번째는 산술 문제였습니다. 성격 유형 136쌍, 다른 분류 체계 66쌍, 혈액형 10쌍을 합치면 192개 조합이고, 여기에 단일 성격 13개를 더해 언어당 205개. 지금 속도로 약 3개월치입니다. 그래서 조합을 순서대로 돌리는 113줄짜리 로테이션 스크립트를 넣었습니다. 점수형 결과 카드라 공유가 잘 될 것이라는 메모도 커밋에 남겼습니다. 이 메모는 기대이고, 아직 확인된 사실이 아닙니다.
두 번째가 이 글의 주제입니다. 대기 큐에 쌓인 글을 claude CLI가 읽고 비진정성, 품질, 정책 세 항목으로 심사해서 반려된 글은 큐에서 빼는 79줄짜리 스크립트를 만들었습니다. 도구를 하나도 주지 않은 순수 판정이라 안전하다고 적었습니다. 검증 결과도 적었습니다. 일본어 5편, 전원 승인.
여기서 질문 하나입니다. 당신의 자동 게이트가 지금까지 통과시킨 것만 있고 막은 것은 하나도 없다면, 그 게이트가 작동한다는 증거는 무엇입니까?
전원 승인이 말해주는 것과 말해주지 않는 것
5편 전원 승인이 말해주는 것은 분명합니다. 스크립트가 끝까지 돌았고, CLI 호출이 성공했고, 판정 결과를 파싱해 큐를 건드리는 경로가 살아 있다는 것. 배관이 연결됐다는 증거로는 충분합니다.
말해주지 않는 것도 분명합니다. 이 심사가 "반려"를 낼 수 있는지, 낼 수 있다면 어떤 글에 내는지, 반려된 글이 실제로 큐에서 빠지는지. 5편이 전부 진짜로 괜찮은 글이었을 수도 있고, 심사가 무엇을 넣어도 승인하는 상태일 수도 있습니다. 두 경우의 출력은 완전히 같습니다. 저는 그 둘을 구분할 데이터를 하나도 만들지 않은 채 "검증"이라고 썼습니다.
더 불편한 점은 이 게이트의 구조입니다. 반려는 큐에서 제거하는 것으로 끝납니다. 반려된 글이 어디에 남는지, 왜 반려됐는지 기록하는 코드는 이 커밋에 없습니다. 만약 어느 날 심사가 전부 반려로 돌아서면 큐가 비고 게시가 멈추는데, 저는 그것을 "오늘은 게시할 게 없었다"로 읽을 겁니다. 반대로 전부 승인으로 돌아서면 지금과 구분이 안 됩니다. 어느 방향으로 고장 나도 제가 알아챌 신호가 없습니다.
"도구가 없어서 안전하다"는 말도 절반만 맞습니다. 심사 프로세스가 파일을 지우거나 API를 부르지 못하는 건 사실입니다. 하지만 그 판정을 받아서 큐를 고치는 쪽은 제 스크립트이고, 그 스크립트는 판정을 의심하지 않습니다. 안전한 것은 심사 단계이고, 위험은 그 다음 줄로 옮겨갔을 뿐입니다.
당신이라면 전원 승인을 보고 파이프라인에 붙이겠습니까, 아니면 반려가 한 번 나올 때까지 기다리겠습니까?
제가 한 것
저는 붙였습니다. 자동 게시 스크립트를 생성, 심사, 게시 세 단계로 늘리고 DRY 모드로 한 번 돌려 통과한 것을 확인한 뒤 커밋했습니다. DRY 검증은 배관 검증입니다. 심사가 옳은 판단을 하는지에 대해서는 이 커밋 시점에 아무것도 확인하지 않았습니다.
그래도 안 붙이는 것보다는 낫다고 판단했습니다. 심사 단계가 없던 어제까지는 대기 큐의 글이 누구의 눈도 거치지 않고 나갔습니다. 무엇이든 승인하는 심사라 해도 어제와 같은 결과이고, 어쩌다 한 편이라도 걸러내면 어제보다 낫습니다. 다만 그 "어쩌다"가 실제로 발생하는지를 알려면, 일부러 나쁜 글을 큐에 넣어 반려되는 것을 한 번은 봐야 합니다. 그 실험은 이 커밋에 들어 있지 않습니다.
자가진단 체크리스트
- 자동 심사 단계를 넣었다면, 그 단계가 "거절"을 낸 사례를 최소 한 건 눈으로 확인했습니까?
- 거절된 항목은 어디에 남습니까? 큐에서 사라지기만 하면 고장과 정상을 구분할 수 없습니다.
- "검증 통과"라고 적을 때, 그 검증이 배관 검증인지 판단 검증인지 커밋 메시지에 구분해 적었습니까?
솔직한 부분
이 커밋 시점에 제가 아는 것은 스크립트가 끝까지 돈다는 것과 일본어 5편이 승인됐다는 것, 둘뿐입니다. 심사가 어떤 글을 반려하는지, 반려율이 얼마인지, 비진정성이라는 기준을 모델이 저와 같은 뜻으로 읽는지는 모릅니다. 로테이션 쪽도 마찬가지입니다. 205개 조합이 3개월치라는 계산은 맞지만, 점수형 결과 카드의 공유력이 높다는 것은 기대일 뿐 이 소재에 근거가 없습니다. 반려 케이스를 의도적으로 만들어 넣는 실험은 아직 하지 않았고, 하기 전까지 이 게이트는 존재는 하지만 작동은 증명되지 않은 상태입니다.