📝 한줄 요약
AI가 만든 요약이 진짜 근거가 있는지 없는지, "감"이 아니라 자동으로 걸러주는 검증 절차를 실제 논문 데이터로 하루 만에 손으로 직접 돌려봤습니다.
바쁘시면 이것만 읽어도 돼요:
Claude Code로 arXiv에서 논문을 실제로 가져와서, 근거 없는 요약은 자동으로 거부되고 페이지 인용까지 있는 요약만 통과되는 걸 눈으로 확인했다
검색어를 잘못 넣어서 전혀 관련 없는 물리학 논문이 쏟아진 사고도 있었지만, 원인을 찾아 고치는 과정 자체가 좋은 공부가 됐다
핵심 깨달음: AI한테 "근거 없이는 답하지 마"라는 규칙을 미리 정해두면 결과물의 신뢰도가 완전히 달라진다
내가 만든 가설을, 대화 맥락을 전혀 모르는 별도의 AI에게 냉정하게 채점받아보니 "보류(재검토)" 판정을 받는 신선한 경험도 했다
워크스페이스 자체의 규칙 문서가 꽤 복잡해서 처음엔 버거웠지만, 한 단계씩 실행하면서 따라가니 결국 다 이해됐다
🎯 이런 분들께 도움돼요
AI로 결과물을 만들긴 하지만, 그게 맞는지 틀린지는 결국 "감"으로만 판단하고 있는 비개발자
AI 결과물 검수·품질 관리에 관심은 있는데 어디서부터 시작해야 할지 막막한 분
"AI가 그럴듯하게 말하는데 진짜인지 모르겠다"는 불안을 느껴본 적 있는 분