[런칭스프린트] 도장봇 개발기 - 4주차

### 소개

도장봇 실제 운영 페이지와 사용자 피드백을 반영한 UX 재설계 프로토타입을 비교·평가하고, 그 결과를 바탕으로 실질적인 개선안을 만들고자 했습니다.

받은 피드백은 단 한 줄이었습니다.

> "도장봇 의견을 남겨드렸어요.

> 사용자입장에서의 전체적인 ux가 다시 설계할 필요가 있어보입니다."

이 한 문장을 진지하게 받아들이고,

“정말 사용자 입장에서 무엇이 문제인지”,

“프로토타입이 그 문제를 얼마나 해결했는지”를

여러 AI의 시선으로 교차 검증해보고 싶었습니다.

단순히 한 모델의 의견에만 의존하지 않고,

Grok → Claude → GPT 순으로 평가를 쌓아가며

합의점과 차이점을 찾아 최종 개선 방향을 도출하는 것이 목표였습니다.

---

### 진행 방법

#### 1. 1차 평가 – Grok

먼저 첨부된 HTML 프로토타입과 실제 사이트(https://dojangbot.onrender.com/simple-app.html)를 Grok에게 주고

서비스 UX 관점에서 냉정하게 비교해달라고 요청했습니다.

주요 요청 내용:

- 피드백을 반영한 프로토타입이 실제 사용자 과업에 얼마나 부합하는지

- 첫 화면, 견적 흐름, 신뢰 설계, 게임 요소 위치 등을 중심으로 평가

Grok은 “견적 먼저” 방향성을 긍정적으로 평가했고,

결과 화면의 신뢰 정보(포함 범위, 추가비, 무료 명시)를 강점으로 꼽았습니다.

다만 모바일 적합성이나 입력 필드 증가 문제는 상대적으로 약하게 다뤘습니다.

#### 2. 2차 평가 – Claude

Grok의 평가 결과를 Claude에게 그대로 보여주고,

동일한 대상을 다시 평가하게 했습니다.

Claude는 더 날카로웠습니다.

- 프로토타입이 실제 리뉴얼이 아니라 IA 재배치 컨셉 목업에 가깝다고 규정

- 데스크톱 사이드바 레이아웃이 모바일 우선 서비스와 반대 방향이라고 지적

- “질문 수를 줄인다”고 하면서 실제로는 입력 필드가 6개로 늘어난 모순을 정확히 짚음

- 기존 콘텐츠(영상, 트렌드, 가격지수)를 어떻게 처리할지 불명확하다고 비판

Claude의 핵심 처방은

“콘텐츠를 새로 만들기보다, 이미 있는 좋은 요소의 노출 순서를 바꾸는 것이 진짜 개정 포인트”였습니다.

#### 3. 3차 평가 – GPT

Grok과 Claude의 평가를 모두 보여주고 GPT에게 세 번째 평가를 요청했습니다.

GPT는 가장 실행 중심적인 평가를 내놓았습니다.

- 기존 페이지 4.5~5점 / 수정안 약 7점 / UX 기획안으로서 9점으로 점수화

- 첫 화면을 더 과감하게 줄여야 한다고 구체적으로 제안

- “아파트명만 입력하면”이라는 약속과 실제 6개 입력의 충돌을 강조

- 견적 결과에 중간값 + 변동 요인 표를 넣는 신뢰 구조를 제시

- Primary CTA를 하나로 통일하고, 5단계 Main Funnel로 줄이는 최종 구조를 제안

#### 4. 비교 및 통합

세 평가를 표로 정리하고,

공통으로 합의된 원칙과 각 모델이 강했던 지점을 추출했습니다.

그 결과를 바탕으로 진정한 개선안을 위한 통합 프롬프트를 작성했습니다.

이 프롬프트에는 Grok의 방향성, Claude의 현실성, GPT의 구체적 실행안이 모두 녹아 있습니다.

사용한 핵심 프롬프트 (요약)

```text

당신은 모바일 우선의 로컬 시공 견적 서비스 UX 전문가입니다.

도장봇의 실제 운영 페이지와 피드백 반영 프로토타입을 모두 검토한 뒤, 최종 개선안을 작성해주세요.

[세 평가에서 합의된 원칙]

1. 첫 방문자의 핵심 과업은 "우리 집 도배·장판 얼마인가?"이다.

2. 견적을 가장 앞으로 가져오고, 게임·트렌드·캐릭터는 뒤로 미룬다.

3. 모바일 우선이어야 한다. 데스크톱 사이드바는 사용하지 않는다.

4. 입력 단계는 가능한 한 줄인다.

5. 고객 화면에 UX 설명 문구를 절대 넣지 않는다.

6. 기존 콘텐츠 자산은 삭제하지 말고 Main Funnel 밖으로 이동시킨다.

7. Primary CTA는 각 화면에서 하나만 둔다.

[반드시 해결해야 할 문제]

- 5초 안에 "아파트 이름 넣으면 견적 나온다"로 이해되어야 한다.

- 입력 필드를 기존보다 늘리지 말 것.

- 견적 결과에 중간값 + "왜 가격이 달라지는지"를 함께 보여준다.

- 결과 이후 Primary CTA는 "이 견적 더 정확하게 받기" 하나로 통일.

...

```

---

### 결과와 배운 점

#### 배운 점

1. 한 모델의 평가만으로는 부족하다

Grok은 방향성을 잘 잡아주었지만, 모바일·입력 마찰 같은 현실적인 문제를 약하게 다뤘습니다.

Claude는 그 약점을 정확히 짚었고, GPT는 실행 가능한 수준까지 구체화했습니다.

세 모델의 시선이 겹치는 지점이 진짜 핵심이었습니다.

2. “방향이 맞다”와 “바로 적용 가능하다”는 다른 문제다

프로토타입이 UX 논리적으로는 좋아 보였지만,

실제 고객 화면에는 UX 설명 문구가 너무 많이 남아 있었고,

레이아웃도 모바일 서비스와 맞지 않았습니다.

3. 약속과 실제 입력의 일치가 중요하다

“아파트명만 입력하면”이라고 해놓고 6개 필드를 받으면

사용자는 바로 불신을 느낍니다. 작은 약속 불일치가 전환을 깎습니다.

4. 콘텐츠를 버리는 것이 아니라 위치를 바꾸는 것이 핵심이다

트렌드, 가격지수, 도배용사 같은 기존 자산은 삭제할 대상이 아니라

Main Funnel 밖으로 빼야 할 대상이었습니다.

#### 나만의 꿀팁

- 평가를 쌓을 때는 이전 평가 전문을 다음 모델에게 그대로 보여주기

→ “너만의 의견”이 아니라 “앞선 평가를 비판적으로 검토”하게 만들 수 있습니다.

- 마지막에는 반드시 통합 프롬프트를 만드세요.

세 평가의 합의 원칙 + 해결해야 할 문제를 한 프롬프트에 몰아넣으면,

다음 단계에서 훨씬 일관된 결과물이 나옵니다.

#### 시행착오

- 처음에는 Grok의 긍정적인 평가에 너무 기운 채 넘어가려 했습니다.

Claude의 날카로운 비판을 받고 나서야 “아, 아직 프로토타입 수준이구나”를 제대로 체감했습니다.

- 프로토타입에 들어 있는 “첫 화면 재설계”, “개선 포인트” 같은 문구가

실제 고객 화면에도 그대로 남아 있다는 사실을 초반에 간과했습니다.

#### 도움이 필요한 부분 / 앞으로의 계획

- 통합 프롬프트로 나온 최종 개선안을 실제 모바일 와이어프레임으로 구체화하는 작업이 남아 있습니다.

- 5초 테스트 / 30초 테스트를 실제 사용자에게 돌려보고,

그 결과를 다시 AI에게 피드백으로 넣어 한 번 더 다듬을 예정입니다.

### 도움 받은 글 (옵션)

이번 작업은 특정 외부 글을 직접 참고하기보다는,

Grok · Claude · GPT의 교차 평가를 통해 스스로 합의점을 찾아가는 방식으로 진행했습니다.

1
2개의 답글
밀어주고 끌어주는

온·오프라인 AI 스터디

AI로 어디까지 할 수 있는지
직접 확인하실 분만 신청하세요.