소개
지난 사례글과 발표에서 나는, 자 료를 쌓아두기만 하는 위키를 넘어 전문성을 갖고 자료를 분석하는 '렌즈'를 깎는 위키 — 내가 '칼날 위키'라고 부르는 걸 만들고 있다고 했다. 잘 쓴 대본 한 편을 AI에게 주고 "분석한 걸 보고 거꾸로 다시 써봐" 시켜서, 못 따라잡은 부분으로 렌즈를 더 날카롭게 깎는 방식(발표의 v2)까지 보여드렸다.
이번 글은 그 다음이다. 그 방법을 한 작품 끝까지 돌려봤고, 두 번째 장르를 더해 렌즈를 한 번 더 갈았다. 그리고 솔직히 말하면 — 분석에 날이 서기 시작했는데, 토큰을 너무 먹어서 잠시 칼을 내려놨다. 이 글은 그 "날이 서기 시작한 지점"과 "왜 잠시 멈췄는지"를 정직하게 적은 기록이다.
1. 칼날 위키란 무엇인가
말이 어려워 보이니 '그냥 LLM wiki'부터 짚자.
LLM wiki는 자료를 쌓아두기만 하는 창고가 아니다. 집어넣고(ingest) · 물어보고(query) · 검토·정리하고(lint) 같은 동작으로 계속 자라고 답하는, 일종의 살아 움직이는 유기체다. 자료가 들어올 때마다 스스로 정리되고, 내가 물으면 그 자료를 엮어 답을 준다.
칼날 위키는 거기서 한 걸음 더 간다. 쌓인 전문 지식을 행동으로 옮길 수 있게 — 즉 피드백을 줄 수 있게, 그러나 한 분야를 예리하게 파고들도록 벼린 위키다. 뭉툭한 만능 칼이 아니라, 한 분야를 깊게 베는 잘 선 칼날.
내 경우 그 분야는 '드라마'다. 더 정확히 말하면 — 대본을 읽고 피드백을 주는 일이다. 잘 쓰는 법(작법)을 가르치는 도구가 아니라, 쓴 걸 읽고 평가·진단하는 도구. 이 구 분이 이 글 내내 중요하니 먼저 박아둔다.
그럼 그 '날'을 어떻게 세우나. 여기서 내가 택한 방법이 재생산(거꾸로 쓰기)이다.
잘 쓴 대본 한 편을 골라 AI에게 분석만 시킨다. 그다음 원본은 감춰버리고, 그 분석 결과(체크리스트)만 손에 쥐여준 채 "이 분석을 보고 같은 이야기를 네 문장으로 다시 써봐"라고 시킨다. 그리고 새로 쓴 걸 원본과 비교한다.
여기서 내가 배우려는 건 하나다 — "내 분석이 진짜 정확한가?"
• 재생산이 어떤 요소를 정확히 살려내면 → 내 분석이 그 요소를 제대로 짚고 있었다는 뜻이다. 분석 기준이 단단한 거다.
• 재생산이 어떤 요소를 끝내 못 살려내면 → 내 분석이 그걸 짚은 줄 알았지만 사실은 뭔가를 뭉뚱그리고 있었다는 뜻이다. 거기를 더 깎아야 한다.
즉 재생산은 분석의 정확도를 재는 리트머스 시험지다. 분석만 시키면 AI는 "이 작품엔 ○○가 있다"까지만 안다. 그게 정확한 판단인지, 아니면 그럴듯한 착각인지는 분석만으론 영영 모른다. 직접 써보게 하면 그제야 검증된다. 레시피를 읽는 것과 실제로 만들어보는 것의 차이다 — 읽을 땐 다 안 것 같지만, 만들어봐야 "내가 이 단계를 잘못 이해했구나"가 드러난다.
2. 재생산이 '평가'를 어떻게 날카롭게 했나
다시 한번 못박는다. 내가 만드는 건 대본을 읽고 피드백을 주는 도구(평가)다. 대본을 잘 쓰게 도와주는 도구(작법)가 아니다. 그러니 이 장에서 보여줄 건 "재생산을 했더니 평 가가 어떻게 날카로워졌나"다. 두 가지로 드러났다.
① 점수 한 개 → 항목별 진단으로. (피드백의 해상도)
렌즈가 없을 때, 내가 대본 한 편에 해줄 수 있는 말은 "음, 10점 만점에 8점쯤? 신선하네"가 전부였다. 왜 8점인지, 어디가 좋고 어디가 빈지는 설명을 못 했다. 그냥 감(感)이었다.
재생산으로 깎은 렌즈를 대고 나니, 같은 대본을 두고 "이 지점은 살아 있고, 저 지점은 비어 있다"를 항목별로 짚어 말할 수 있게 됐다. 점수 한 개짜리 감상이 진단서가 된 거다. 이게 재생산이 평가에 한 첫 번째 일이다 — 피드백의 해상도를 올렸다.
한 가지는 정직하게 짚자. 이건 "내가 평가를 더 잘하게 됐다"기보다 "AI에게 시킨 평가가 구체적으로 나오게 됐다"에 가깝다. 그리고 그 구체적인 진단이 진짜 맞는지는 또 다른 문제다. 그래서 ②가 중요하다.
② 진짜 날은 "못 쓴 걸 못 썼다고 잡아내는가"에 있다. (예리함의 기준)
여기서 내가 가장 경계한 함정이 있다. 잘 쓴 대본은 어떤 도구로 재도 점수가 잘 나온다. 프로가 썼으니까. 그러니 "잘 쓴 대본이 좋게 평가됐다"는 건 칼이 예리하다는 증거가 못 된다 — 그냥 프로가 썼다는 증거일 뿐이다. 무딘 칼도 거기선 똑같이 "좋네요"라고 말한다.
예리한 평가 도구의 진짜 시험은 정반대다. 일부러 못 쓴 대본을 넣었을 때, 점수가 뚝 떨어지는가. 떨어지면 날이 선 거고, 그래도 다 "통과"로 나오면 무딘 거다. 무딘 칼은 자기가 무딘 줄도 모른 채 모든 대본에 "좋아요"