AI에게 일을 시키는 것을 넘어, Agent Harness로 통제해보기

소개

시도하고자 했던 것과 그 이유를 알려주세요.

AI가 법령 자료를 읽고 결과를 만드는 것만으로는 실제 업무에 적용하기 어렵다고 판단했다. Wiki가 근거를 관리하고, Skill이 판단하며, Gate와 Proof가 완료 여부를 검증하는 Agent Harness 구조를 설계하고자 했다.

활용한 툴

  • Hermes Agent: 로컬 HTML 가이드와 기존 SHE 맥락 분석

  • Markdown: Harness 계약서와 실행 구조 작성

  • 파일 Readback: 작성한 계약서의 실제 저장 상태 확인

진행 방법

어떤 도구를 사용했고, 어떻게 활용하셨나요?

Tip: 사용한 프롬프트 전문을 꼭 포함하고, 내용을 짧게 소개해 주세요.

Tip: 활용 이미지나 캡처 화면을 꼭 남겨주세요.

Tip: 코드 전문은 코드블록에 감싸서 작성해주세요. ( / 을 눌러 '코드 블록'을 선택)

1️⃣ gpters-agent-harness-llm-wiki-guide.html을 읽고 Source → Skill → Gate → Proof 구조를 추출했다.

2️⃣ 대표 사업장 1곳, 환경법규 1개, 정상 조업 3개월을 대상으로 하는 SHE-Compliance-Harness v0.1 Contract를 작성했다.

3️⃣ 검증 결과를 PASS / FAIL / HELD로 구분하고, 자료 부족 시 AI가 추정하지 않도록 설계했다.

사용한 프롬프트는 다음과 같다.

우리의 SHE 업무를 Agent Harness 형태로 발전시키고 싶어. 기존 Wiki, Skill, 자료 구조를 바탕으로 무엇부터 고정해야 하는지 단계별로 정리해줘.

배운 점과 나만의 꿀팁을 알려주세요.

과정 중에 어떤 시행착오를 겪었나요?

도움이 필요한 부분이 있나요?

앞으로의 계획이 있다면 들려주세요.

시행착오

처음에는 안전·환경·ESG 업무를 역할별 Skill 파일로 많이 나누려고 했다. 그러나 역할이 9개라고 해서 반드시 파일도 9개가 필요한 것은 아니며, 책임·입출력·실패 신호가 다를 때만 분리해야 한다는 점을 확인했다.

배운 점

Agent Harness는 자동화 도구가 아니라 업무의 시작·판단·검증·승인·복구·기록을 통제하는 구조에 가깝다. 특히 “완료했다”는 응답보다 실행 영수증과 Readback이 중요하다는 점을 배웠다.

향후 계획

처음부터 전체 SHE 업무를 자동화하지 않고, 대표 사업장 1곳의 환경법규 검증부터 시작한다. 실제 자료를 넣기 전에 Intake, Routing, Verification, Gate의 책임과 실패 조건을 하나씩 고정할 예정이다.

도움이 필요한 점

첫 파일럿의 범위가 과도하게 커지지 않도록 검증 법령 1개와 최소 Evidence 패키지를 정하는 데 도움이 필요하다.

도움 받은 글 (옵션)

참고한 지피터스 글이나 외부 사례를 알려주세요.

(내용 입력)

3
3개의 답글
밀어주고 끌어주는

온·오프라인 AI 스터디

AI로 어디까지 할 수 있는지
직접 확인하실 분만 신청하세요.