소개
시도하고자 했 던 것
1주차 과제에서는 Airtable MCP를 구성하여 고객 데이터를 활용한 관계형 테이블을 만들었습니다. 2주차는 그 연장선이 아닌, Claude 스킬 활용 자체를 다루었습니다. 마침 실무에서 진행 중이던 서비스 매뉴얼 한국어 표준화 번역 작업이 있었고, 이 반복적인 문서 생성 작업을 Claude 스킬로 구조화하는 것을 2주차 과제로 연결했습니다.
단순히 번역을 계속하는 것이 아니라, 어떻게 하면 Claude가 매번 동일한 품질의 지침서 docx를 자동으로 뽑아낼 수 있을까를 스킬 설계 관점에서 접근했습니다.
그 이유
지침서는 구조가 매우 규칙적입니다. 탈거 → 분해 → 점검 → 조립 → 장착의 흐름, 경고/주의/참고 박스, 좌텍스트+우이미지 2열 레이아웃이 수백 페이지 반복됩니다. 이 구조를 스킬로 정의해두면 챕터 단위로 빠르게 완성본 docx를 뽑을 수 있겠다고 판단했습니다. 한 챕터(22페이지)를 수작업으로 하면 하루 이상 걸리지만, 자동화하면 한 세션 내에 완성할 수 있습니다.
진행 방법
사용 도구: Claude (claude.ai), Node.js + docx-js, Python (Pillow, pdfimages), bash
전체 흐름
PDF 원문 → 이미지 추출(pdfimages) → 번역·표준화 → JS 스크립트 생성
→ docx-js로 .docx 빌드 → validate → 언팩(XML 직접 수정) → 최종 출력1단계: 스킬 정의
automotive-service-manual 스킬을 먼저 읽혀서 문서 구조·XML 패턴을 파악하게 했습니다.
사용한 프롬프트:
템플릿화 된 내용을 토대로 17번 파일 작업을 진행해주세요.인수인계 문서(섹션 구조, 확정 용어표, 서식 규칙, 이미지 매핑 JSON)를 함께 첨부하여 컨텍스트를 한 번에 전달했습니다.
2단계: PDF 이미지 자동 추출 및 페이지 매핑
python
# pdfimages로 전체 이미지 추출 후 페이지-이미지 매핑
pdfimages -list 17_Brake.pdf
# 로고(26,923 bytes 이하) 자동 필터링
# 실제 절차 이미지만 페이지별 딕셔너리로 정리
page_images = {
3: ['img-003.jpg','img-004.jpg','img-005.jpg','img-006.jpg'],
4: ['img-008.jpg','img-009.jpg'],
# ...
22: ['img-078.jpg','img-079.jpg'],
}3단계: 로고 투명 배경 처리