1. 시작은 "통과했다는 말을 믿을 근거가 없다"였습니다</h2><p>검수기를 만들고 문서를 넣었더니 통과가 나왔습니다. 기분은 좋은데, 곧 불편한 생각이 따라옵니다. <strong>이 통과는 문서가 멀쩡해서 나온 것인가, 검사기가 아무것도 못 봐서 나온 것인가.</strong></p><p>두 경우의 출력이 똑같습니다. 결함이 없는 문서를 검사한 결과도 "통과"이고, 결함을 못 알아보는 검사기가 결함투성이 문서를 검사한 결과도 "통과"입니다. 화면만 보고는 둘을 못 가릅니다. 심지어 <strong>검사가 0개 돌았을 때의 출력</strong>도 전부 통과와 비슷하게 보입니다.</p><p>여기서 방향이 하나 바뀝니다. 검수의 대상이 문서만이 아니라는 것입니다. <strong>측정기 자체가 측정 대상이어야 합니다.</strong> 자를 믿고 길이를 재기 전에, 자가 눈금대로 생겼는지 한 번은 봐야 합니다.</p><h2>2. 그래서 이번에 정한 질문 하나</h2><p>"검수기를 어떻게 더 정확하게 만드나"가 아니었습니다. 질문은 이것이었습니다.</p><blockquote><p><strong>이 검수기가 실제로 무언가를 했다는 것을, 무엇으로 아는가.</strong></p></blockquote><p>이 질문은 대상이 아니라 <strong>도구</strong>를 겨눕니다. 그리고 답이 하나뿐이었습니다 — 답을 아는 문제를 주고 채점해 보는 것. 결함이 있다는 것을 내가 아는 문서를 넣어서, 검사기가 그것을 잡는지 봅니다. <strong>거부한 적이 없는 검사는 검사가 아닙니다.</strong></p><h2>3. 사용한 개념과 도구 — 세 층, 그리고 전/후라는 축</h2><p>재귀 검수라고 부르지만 구조는 단순합니다. 층이 세 개입니다.</p><pre><code>1층 대상 문서·데이터 → 검수기가 본다 → 결함이 있는가
2층 측정기 검수기 자신 → 심은 결함으로 채점 → 검사기가 잡는가
3층 자기 적용 우리가 만든 산출물 → 같은 검수기에 넣는다 → 우리도 통과하는가</code></pre><p>그리고 이 세 층을 가로지르는 축이 하나 더 있습니다. <strong>전/ 후</strong>입니다. 검수기를 고쳤을 때 "좋아졌다"고 말하려면, 옛것과 새것을 <strong>같은 문제</strong>로 채점해야 합니다. 서로 다른 문서로 잰 두 점수를 비교하는 것은 비교가 아니라 두 개의 다른 이야기입니다.</p><pre><code>전/후 옛 검수기 · 새 검수기 → 같은 문제로 채점 → 차이가 곧 개선의 크기</code></pre><p>★ 한 가지 미리 밝혀둡니다. 이 구조는 <strong>완전한 검증이 아닙니다.</strong> 2층을 재려면 3층이 필요하고, 3층을 재려면 4층이 필요합니다. 재귀는 원리상 끝나지 않습니다. 그래서 <strong>어디서 멈출지를 미리 정하는 것</strong>이 이 설계의 일부입니다. 저는 사람의 승인에서 멈춥니다(§8).</p><h2>4. 실제로 지킨 규칙 세 개와, 그 규칙이 막는 실패</h2><h3>① 측정기를 먼저 공격한다 — 통과가 검사기의 침묵인지 대상의 무결인지 못 가리는 것을 막는다</h3><p>검사기에 답을 아는 결함을 일부러 심고, 그것을 잡는지 봅니다. 잡으면 그 검사기의 통과는 의미가 생기고, 못 잡으면 그 검사기의 통과는 <strong>아무 뜻도 없습니다.</strong> 실제로 결함을 주입해 위치까지 검출되는지, 복구하면 다시 통과하는지를 재현으로 확인한 기록이 있습니다(07-INTEGRITY 편).</p><p>이 습관이 만든 가장 중요한 발견은 <strong>검사의 층이 다르면 보는 것이 다르다</strong>는 것이었습니다. 줄 수만 세는 검사는 줄 수가 맞는데 글이 빠진 경우를 통과시켰습니다. 그 위에 중복 검출을 얹으니 다른 종류가 걸렸고, 완전일치 대조까지 올려야 남은 것이 잡혔습니다. 층을 올리기 전에는 <strong>아래층의 통과가 전부인 줄 알았습니다.</strong></p><h3>② 자기 산출물을 예외로 두지 않는다 — 규격이 자기에게만 관대해지는 것을 막는다</h3><p>검수기는 보통 남이 만든 것, 기계가 만든 것에 겨눠집니다. 그런데 <strong>내가 쓴 초안</strong>은 슬그머니 검수 밖에 놓입니다. "내가 쓴 거라 내가 안다"가 이유인데, 그 이유는 검수를 면제할 근거가 아니라 검수가 필요한 이유에 가깝습니다.</p><p>실제로 자기 초안을 승격 문턱의 검증 좌석에 통과시켰을 때, <strong>내 초안에서 오류 2건이 잡혔습니다</strong>(11-PROMOTE 편). 만든 사람이 스스로는 못 본 오류였습니다. 같은 이유로 채점은 만든 자리가 아닌 다른 자리에서 했습니다 — 아이디어 5건을 두 좌석이 따로 채점해 3건만 통과시킨 기록이 있습니다(10-SURVEY 편).</p><h3>③ 전/후를 같은 문제로 비교한다 — "좋아졌다"를 주장인 채로 두는 것을 막는다</h3><p>성능이 올랐다는 말은, 옛것과 새것을 같은 문제로 채점하기 전까지 주장입니다. 그래서 답을 아는 결함을 심어 두 검수기를 같은 문제로 채점했습니다(09-INSPECT 편).</p><p>그 결과에서 가장 값진 줄은 <strong>개선이 없었던 줄</strong>이었습니다. 인용 표시가 붙은 결함은 옛 검수기도 30/30, 새 검수기도 30/30으로 <strong>동률</strong>이었습니다. 이 동률이 개선의 성격을 정확히 말해줍니다 — 새 검수기가 더 똑똑해진 것이 아니라, 옛 검수기가 <strong>구조적으로 볼 수 없던 영역</strong>을 검사 범위에 넣은 것입니다. 전/후 비교가 없었다면 이 개선을 "검수기가 더 정확해졌다"고 잘못 설명했을 것이고, 그것은 사실이 아닙니다.</p><h2>5. 지금까지 관찰된 결과 (전부 기발행 값 · 미측정은 미측정이라고 적습니다)</h2><p>⚠ 이 표에는 이 글을 위해 새로 잰 값이 <strong>없습니다.</strong> 오른쪽 칸에 어느 편에서 왔는지 적었습니다.</p><table><thead><tr><th>층</th><th>관찰된 값</th><th>기발행 출처</th></tr></thead><tbody><tr><td>측정기 채점</td><td>답을 아는 결함 150개(5클래스 × 30)로 옛·새 검수기를 같은 문제로 채점</td><td>09-INSPECT</td></tr><tr><td>측정기 채점</td><td>검사 가시 범위 옛 40% → 새 100%</td><td>09-INSPECT</td></tr><tr><td>측정기 채점</td><td>인용 붙은 결함 적발 옛 30/30 = 새 30/30 (<strong>동률</strong>)</td><td>09-INSPECT</td></tr><tr><td>측정기 채점</td><td>인용 없는 결함 적발 옛 0 → 새 60/60</td><td>09-INSPECT</td></tr><tr><td>측정기 채점</td><td>정상 문장 오탐 0 / 30 · 실행 약 30초</td><td>09-INSPECT</td></tr><tr><td>자기공격</td><td>결함 주입 → 위치까지 검출 → 복구 → 통과 (재현 확인)</td><td>07-INTEGRITY</td></tr><tr><td>검사 층</td><td>줄 수만 세는 검사가 통과시킨 유실 2건 · 무증상 탈락 6건</td><td>07-INTEGRITY</td></tr><tr><td>검사 층</td><td>완전일치 대조 551조각 결함 0</td><td>07-INTEGRITY</td></tr><tr><td>자기 적용</td><td>승격 전 <strong>내 초안</strong>에서 잡힌 오류 2건</td><td>11-PROMOTE</td></tr><tr><td>자기 적용</td><td>원장 판정 10줄 = 보류 9 · 기각 1</td><td>11-PROMOTE</td></tr><tr><td>채점 분리</td><td>아이디어 초안 5건 → 두 좌석 독립 채점 → 통과 3 · 보류 2</td><td>10-SURVEY</td></tr><tr><td>채점 분리</td><td>원문 대조 인용 13건 · 인용 수치 불일치 0건 · 중대 플래그 1건</td><td>10-SURVEY</td></tr><tr><td><strong>3층 전/후</strong></td><td><strong>미측정</strong> — 우리가 쓴 글 자체를 우리 검수기에 넣은 전/후 비교는 진행 중이고 결과 없음</td><td>(해당 없음)</td></tr></tbody></table><p>마지막 줄이 이 글의 정직한 자리입니다. 1층과 2층은 이미 값이 있고, <strong>3층은 사상만 있고 수치가 없습니다.</strong> 여기에 그럴듯한 숫자를 채우는 순간 이 글은 자기가 반대하는 것을 하게 됩니다 — 재보지 않은 것을 통과로 적는 일입니다.</p><p>그리고 표에서 두 번 나오는 <strong>2건</strong>은 서로 다른 사건입니다. 07의 2건은 검사기가 놓친 유실이고, 11의 2건은 검증 좌석이 내 초안에서 잡은 오류입니다. 같은 숫자라고 같은 이야기로 읽지 않으시길 바랍니다.</p><h2>6. 따라 해보고 싶으시면 — 가장 작은 형태부터</h2><p>검수기가 없어도, 검사 한 개만 있으면 오늘 할 수 있습니다.</p><p><strong>1) 검사 하나에 답을 아는 결함을 하나 심어 보십시오.</strong> 통과하던 것이 걸리는지만 봅니다. 안 걸리면 그 검사는 지금까지 아무것도 안 하고 있었던 것입니다.</p><p><strong>2) 정상인 것도 한 번 넣어 보십시오.</strong> 결함을 잡는 것만큼 <strong>