소개
AI에게 논문 요약을 시키면 결과물은 늘 그럴듯합니다. 문제는 확인할 방법이 없다는 거예요.
"효과가 있었다" 같은 뭉뚱그린 문장만 나옴
수치를 물으면 숫자를 말해주는데 원문 어디에도 없음
페이지를 물으면 페이지를 말해주는데 그 페이지에 그 내용이 없음
제일 무서운 건 세 번째입니다. 수치는 맞는데 페이지만 틀린 인용은 눈으로 검토해도 안 걸려요. 확인하려면 85쪽짜리 PDF를 다시 열어야 하니까요.
그리고 서베이는 시작하기 전부터 막히는 게 하나 더 있습니다. "내가 뭘 모으고 싶은지"를 규칙으로 옮기는 일이요. 키워드를 넣어보면 반드시 포함 " ", 제외 -를 입력해도 때에 따라서 모두 포함되거나 모두 제외되기도 합니다.
그래서 이번엔 모든 수치와 인용이 원문 페이지로 되짚어지는 서베이를 만들어보기로 했습니다.
목표는 두 가지였어요.
검증을 사람 눈이 아니라 스크립트로 넘기기 — 요약의 모든 수치·인용을 원문과 자동 대조
AI가 못 하는 건 못 한다고 말하게 하기 — 자료가 없으면 채우지 말고 그 사실을 남기기
진행 방법
사용한 도구
항목
내용
도구
Claude Code (터미널)
모델
Claude Opus 5
플러그인
eric-research-survey — 서베이 파이프라인 스캐폴딩 + 결정론 검수 게이트
의존성
python3 표준 라이브러리 + pdfplumber (PDF 텍스트 추출)
데이터 소스
ERIC — 미국 교육부 교육학 문헌 DB · 무료 · API 키 불필요
ERIC은 세 경로를 다 씁니다.
검색: https://eric.ed.gov/
API: https://api.ies.ed.gov/eric/
전문 PDF: https://files.eric.ed.gov/fulltext/<ID>.pdf
실제로 입력한 프롬프트 전문
① 시작 — 폴더 하나 가리키고 주제만 던짐
"D:\2026\2026work\AI-agents\eric-research-survey"이용해서 eric에서
주제 [ ] 관련 논문을 가져와줘.
이 목적에 맞게 워크스페이스를 구축해줘.
② 첫 사이클 실행
program-design-partnership 카테고리로 한 사이클 돌려줘
③ 두 번째 사이클
mentoring-supervision 카테고리도 돌려줘
④ 중간 점검 — 진짜 만들어졌는지 확인
워크스페이스 구축한 거 맞아?
⑤ 나머지 전부
남은 카테고리 3개도 이어서 돌려줘
Claude가 되물은 것 — 만들기 전에 자료부터 쟀다
①번을 입력했을 때 바로 만들지 않고 ERIC을 먼저 두들겼습니다.
ERIC에 자료가 충분합니다 — "주제 [ ] 관련", 2015년 이후 219편, 동료심사만 142편입니다.
그리고 세 가지를 한 번에 물어봤어요. 선택지만 고르면 되니 편했습니다.
질문
선택지
제 선택
워크스페이스 위치
AI-agents 아래 / 2026work 아래
AI-agents 아래
코퍼스 범위
2015년+ 전체 219편 / 동료심사만 142편 / 연도 무제한 236편
219편 전체
분류 체계
4개 하위 카테고리 / 단일 카테고리 / 반입 후 결정
4개 하위 카테고리
"만들어놓고 보니 자료가 없더라"를 방지하는 순서입니다.
📷 (이미지 자리 — ERIC 사전 조사 결과와 선택지 질문 화면)
만들어진 것
teacher-residency-survey/
├─ 00-system/taxonomy.json 출현율 기반 5카테고리 분류 규칙
├─ 60-data/corpus.json ERIC 219편 (제목·초록·메타데이터)
├─ 60-data/raw/ PDF 42편 + 페이지별 추출 텍스트
├─ 40-drafts/ 검증 통과 요약 42건
├─ 70-analysis/ 카테고리별 랭킹·쇼트리스트
├─ 80-reports/interim/ 서베이 리포트 5건
└─ _meta/run-state.json 사이클 진행 상태(중단·재개용)
워크스페이스가 만들어진 뒤 Claude가 표준 정합성을 자동 검증했습니다. "만든 것 같다"가 아니라 검사를 돌려서요.
CLAUDE.md 12섹션 / 10단위 폴더 넘버링 / 빈 폴더 .gitkeep /
메타파일 4종 / 플레이스홀더 잔존 0 → 전건 통과