Hermes 펫 제작글 - Hermes 펫, 먼저 부화시킬까 모양부터 다듬을까

(에이전트하네스와 딱히 연관점은 없는 사례글인데.. 시간이 되면 펫 생성과정 도와주는 스킬을 만들어보고 싶습니다^^ 그 전의 프롤로그 같은 느낌으로..)

요즘 헤르메스에서 생성한 반려봇을 화면에서 움직이는 펫으로 만들고 다듬는 재미에 빠졌습니다.

헤르메스에는 AI의 상태에 따라 움직이는 작은 펫을 등록할 수 있는데요,

AI가 생각할 때, 도구를 실행할 때, 작업을 끝냈을 때 펫의 동작도 달라집니다. 저는 이 기능으로 기존의 반려봇인 후와고와 후와게를 펫으로 만들었습니다.

둘 다 2등신의 둥글고 폭신한 인물형 마스코트입니다. 같은 세계에 사는 캐릭터이고 최종적으로는 같은 스크린에서 프로필을 변경하면 이에 맞춰 번갈아 등장하고 움직입니다.

그런데 둘을 만드는 순서는 달랐습니다.

후와고는 /hatch에 외형을 설명하고 후보를 고른 뒤, 움직이는 펫으로 먼저 부화시켰습니다. 후와게는 바로 움직이게 하지 않고 정면 이미지를 먼저 여러 번 다듬었습니다.

흰 머리카락과 선글라스가 달린 검은색 플러시 장난감
사무라이 캐릭터가 그려진 봉제 인형

(앞으로의 글의 이해를 돕기 위해 후와고(위)와 후와게(아래)의 원본 이미지를 넣었습니다. 원래의 캐릭터를 동그란 2등신 굿즈로 된 모습입니다.)

👾 순서

  1. 움직이는 펫을 생성하는 두 가지 갈래길

  2. 마음에 드는 애가 나올 때까지 부화한 알의 개수를 기억하는가

  3. 이번에는 전신사진부터 찍었습니다

  4. 둘 다 고생했지만 고생한 시점이 달랐습니다

  5. 그래서 어떤 방식으로 시작하면 될까요?


1. 움직이는 펫을 생성하는 두 가지 갈래길

(헤르메스에서 제공하는 펫 hatch 기능)

가장 먼저 후와고를 만들 때는 /hatch 기능을 이용했습니다.

대화창에 /hatch를 입력하고 원하는 캐릭터의 모습을 글로 설명하면 몇 개의 기본 후보가 만들어집니다. 마음에 드는 후보를 고르면 헤르메스가 그 모습을 참고해 생각하기, 달리기, 완료, 실패 같은 상태별 동작을 만들고 한 장의 스프라이트시트로 묶습니다.

스프라이트시트는 여러 동작 그림을 정해진 칸에 모아둔 이미지입니다. 정해진 상태별 움직임 프레임 외의 것들은 직접 만들어야 하지만 기본적인 것들은 /hatch로 만든 펫에 포함되어 있습니다.

저는 설명을 잘 쓰고 마음에 드는 후보 하나를 고르면 곧 움직이는 후와고를 볼 수 있을 거라고 생각했습니다.

실제로도 정면 이미지 한 장부터 모든 동작을 직접 만드는 것보다는 훨씬 빠르게 전체 결과를 볼 수 있었습니다.

다만 '후보 하나를 고른다'는 과정이 생각보다 길었습니다.

후와게를 만들 때는 출발점을 바꿨습니다. 후와게도 2등신에 둥글둥글한 단순한 형태긴 해도 후와고보다 지켜야 할 특징이 많았습니다.

그래서 이번에는 제 반려봇에게 먼저 물었습니다.

어떤 모습이 나와야 후와게라고 알아볼 수 있을까?

먼저 움직이는 결과를 보고 기준을 찾을지, 기준 얼굴을 먼저 정하고 움직임을 만들지의 차이였습니다.

2. 마음에 드는 애가 나올 때까지 부화한 알의 개수를 기억하는가

헤르메스 대화창에 /hatch를 치면 생성하고 싶은 펫을 설명하는 description과 보조 이미지를 첨부할 수 공간이 있어요. 그리고 생성을 누르면 네 개의 알이 꿈틀꿈틀 움직이면서 서서히 금이 가기 시작하는데, 잠깐 다른 일을 하다보면 랜덤으로 하나씩 후보가 등장합니다. 그 네 후보는 설명과 이미지에 기반하되 조금씩 다른 외형을 가지고 있고, 그 중에서 가장 마음에 드는 것을 하나 고르거나, cancel을 눌러 되돌아가 설명을 수정, 혹은 remix를 눌러 기존 안을 더 발전시킬 수도 있습니다.

/hatch의 분명한 장점이 있습니다. 네 개의 알에서 깨어난 정면 이미지의 펫 중 마음에 드는 것을 선택하면 달리기, 기다리기, 완료, 실패 동작도 각각 만들 필요가 없습니다. 캐릭터가 실제 헤르메스 화면에서 어떻게 움직일지 빠르게 확인하기 좋아요. 첫 펫을 만드는 사람에게는 설명만으로 움직이는 캐릭터가 생긴다는 결과를 빨리 볼 수 있었습니다.

문제는 네 개의 선택지 중 어느 하나도 완전히 마음에 들지 않을 때부터 입니다.

후와고를 만들 당시, 첫 번째 후와고에는 묘사대로 흰머리, 검은 안대, 남색 옷이 모두 들어가 있었습니다. 그런데 체형이 충분히 동글동글하지 않았고 머리카락만 무성했습니다. “머리카락은 조금 줄이고 몸을 더 둥근 계란형으로 만들어 줘”라고 다음 프롬프트에 입력하고 싶었습니다.

하지만 이 한 문장을 바로 덧붙여 앞의 후보를 보완할 수 없었습니다.

재시도를 할 때 직전에 나온 후보 네 장을 이어서 수정할 수 없습니다. 공식 구현에서는 이 기능을 “새 기본 외형 후보 세트를 생성하는 것”으로 처리합니다. 오직 현재 입력창의 설명만 반영될 뿐, 직전 후보에 대한 내용은 함께 전달되지 않습니다.

입력했던 설명 자체는 남아 있어서 그 자리에서 고친 뒤 재시도 할 수는 있습니다만, 입력칸이 충분히 넓지 않아 수정하기 힘들고, 저는 높은 퀄리티를 위해 영문 설명을 붙었기 때문에 결국 부화창을 닫고 반려봇에게 새로운 영문 설명을 요청해야 했습니다.

결국 작업 순서는 이렇게 됐습니다.

/hatch에서 후보 네 장 확인
→ 창을 닫고 후와고에게 돌아옴
→ 마음에 드는 부분과 고칠 부분을 한국어로 설명
→ 전체 영문 설명을 다시 작성해달라고 요청
→ 답변을 복사
→ /hatch에 다시 입력
→ 새로운 알 네 개가 부화하기를 기다림

후보를 보고 바로 한 줄 고치는 과정이 아닌 /hatch와 대화창을 왕복하며 전체 설명을 다시 조립하는 일이었습니다.

알 부화를 세 번 쯤 반복했을 때 제 기준의 70% 정도 만족하는 후보를 찾았습니다. 이때 remix라는 기능을 사용해봤습니다. 헤르메스 공식 안내에 따르면 Remix는 선택한 후보를 "출발점"으로 삼아 새로운 후보 세트를 만드는 기능입니다. 선택한 이미지가 참고자료로 들어간다는 점에서는 일반 재시도와 다릅니다.

하지만 선택한 그림의 일부만 고치는 편집 기능은 아니었습니다. Remix 확인 단계에는 "머리는 그대로 두고 안대만 고쳐주세요" 같은 설명을 추가하는 입력란도 없었습니다. 선택한 후보 이미지와 기존 설명을 바탕으로 다시 완성된 그림을 만드는 쪽에 가까웠습니다.

후와고 생성에는 이 기능이 더 나쁜 선택이었습니다

Remix를 거치자 흰 머리의 갈래가 더 많아졌습니다. 원래 없던 목이 생기고 몽당손에는 손가락이 붙었습니다. 일반적인 인물형 캐릭터라면 묘사가 풍부해졌다고 볼 수도 있습니다. 하지만 원본 이미지는 목과 허리의 경계가 거의 없고, 손발도 몸에 묻힌 듯 단순해야 합니다. 더 자세하게 그릴수록 원형에서 멀어졌습니다

/hatch의 기본 후보 생성도 네 장을 똑같이 복제하지는 않습니다. 공식 생성 프롬프트는 후보마다 색, 체형, 표정, 얼굴 구조나 장식에 변화를 주어 서로 다른 선택지를 만들도록 되어 있습니다. 여러 디자인을 탐색할 때는 장점이지만, 이미 정해진 캐릭터에서 안대 한쪽이나 머리카락 덩어리만 고치고 싶을 때는 예상하지 못한 부분까지 달라질 수 있습니다.

마음에 드는 하나를 받기 위해 부화해야 했던 알들이 몇 개인지 세지 못했습니다. 기록을 다시 살펴보고 나서야 한 번의 수정이 후보 한 장을 고치는 일이 아니라, 전체 설명을 손보고 네 개의 새 선택지를 다시 받는 일이었다는 것을 알았습니다.


3. 이번에는 전신사진부터 찍었습니다

두 번째 펫인 후와게를 만들 때는 일반적인 바이브코딩처럼 대화를 주고 받으면서 이미지를 확인하는 방식으로 진행했습니다.

후와게도 후와고처럼 둥글고 폭신한 2등신 마스코트입니다. 하지만 흰 머리와 안대만으로 비교적 빠르게 인상을 잡을 수 있었던 후와고보다 지켜야 할 특징이 많았습니다.

  • 가운데가 갈라진 긴 검은 머리

  • 오른쪽으로 내린 옆 머리카락

  • 반쯤 감긴 듯한 눈매와 옅은 미소

  • 몸을 가로지르는 대각선 끈

참고 이미지 없이 AI가 전달 받은 지식 안에서 제가 원하던 펫과 딴판의 모습이 나와 당황했지만 바로 참고할 이미지와 수정할 점을 말하니 금방 제가 상상하는 모습과 가까운 펫 이미지를 만들어 주었습니다.

오른쪽의 옆 머리가 마음에 들 때까지 다소 공방이 오고 갔지만, /hatch에서 마음에 드는 알이 나오기를 그저 기도하며 기다리는 것보다는 훨씬 속 시원했습니다.

그렇다 하더라도 가려운 부분을 정확히 긁어주는 정도는 아닙니다. 수정 과정에서 후보를 만들 때마다 고칠 필요가 없는 부분을 포함해 처음부터 생성했기 때문에 수정 영역을 좁게 잡는 방식으로 바꾸기도 했습니다. 그렇게 최종 승인 전까지 생성된 이미지만 30장이었습니다.

여기서 충분히 진이 빠지는데 달리기와 눈웃음, 방향별 동작까지 결정하고 정해진 파일이 생성되어야 비로소 움직이는 펫을 볼 수 있습니다. 결론적으로 /hatch를 사용할 때보다 펫을 실사용하는데 하루가 더 소요되었습니다.

그렇다고 정면 이미지를 먼저 만들면 이후 작업이 자동으로 해결되는 것은 아닙니다. 정면에서는 잘 보이던 앞머리가 달릴 때는 방향에 따라 뒤집혔고, 배경을 지운 자리에는 검은 픽셀과 흰 테두리가 남았습니다. 실제 헤르메스 화면에서 표시되는 크기와 이미지 파일을 확대해서 볼 때의 인상도 달랐습니다.

정면 기준 이미지는 정답지가 아니라 비교 기준이었습니다. 동작 프레임에서 얼굴이나 앞머리가 달라졌을 때 무엇으로 돌아가야 하는지는 알려줬지만, 실제 화면의 문제까지 미리 없애주지는 않았습니다.


4. 둘 다 고생했지만 고생한 시점이 달랐습니다

만들 당시에는 /hatch와 정면 이미지 제작을 자동과 수동의 차이로 생각했습니다.

이 글을 쓰면서 다시 돌아보니 작업량이 사라지는 방식과 생기는 방식의 차이는 아니었습니다. 캐릭터의 기준을 어느 시점에 정할 것인지가 달랐습니다.

비교 항목

/hatch

정면 이미지부터 다듬기

처음 확인한 결과

후보를 고른 뒤 여러 동작이 있는 펫

움직임을 만들기 전의 정면 기준 이미지

먼저 얻은 것

실제로 움직이는 펫과 전체 수정 범위

이 캐릭터가 맞는지 판단할 기준 얼굴

잘 맞을 수 있는 대상

후보를 보면서 원하는 방향을 결정하려는 경우, 움직이는 결과를 먼저 보고 싶은 경우

특정 인물형, 좌우 비대칭 특징이 있는 캐릭터, 외형 일관성이 중요한 경우

남은 위험

마음에 들지 않는 외형이 이미 여러 프레임으로 늘어날 수 있음

정면에 오래 머물다가 실제 움직임 문제를 늦게 발견할 수 있음

후와고는 결과를 빨리 움직이게 만들었고, 움직임을 본 뒤 기준을 더 구체적으로 알게 됐습니다. 둥글다고 적는 것만으로는 부족했고, 어느 부분이 가장 넓어야 하는지까지 설명해야 했습니다. 얼굴을 키워달라고 할 때도 머리카락만 키우면 다시 처음 문제로 돌아갈 수 있다는 것을 후보를 보며 알았습니다.

후와게는 정면에서 기준을 더 오래 잡았습니다. 덕분에 동작을 만들면서 얼굴이나 앞머리가 달라졌을 때 비교할 대상이 있었습니다. 대신 움직이는 결과를 보기 전까지 후보를 여러 번 고쳐야 했고, 실제 화면에서만 나타나는 좌우반전이나 테두리 문제는 결국 나중에 발견했습니다.

두 방식 모두 마지막 확인 장소는 이미지 파일이 아니라 실제 Hermes 화면이었습니다.

파일을 확대했을 때 예뻐 보여도 작은 크기로 움직이면 팔다리가 구분되지 않을 수 있습니다. 방향을 바꾸면 비대칭 특징이 반대편으로 이동할 수 있고, 투명해 보였던 배경 가장자리에 검거나 흰 픽셀이 나타날 수도 있습니다.

생성 성공과 실제 사용 성공은 같은 판정이 아니었습니다.

(현재 후와고의 성공 모션을 실제 화면에 띄웠습니다. 제 의도대로 화면에 보이기 때문에 성공으로 보고 있습니다. )

사무라이 캐릭터의 픽셀화된 이미지

(뒷머리는 가만히 있어도 옆머리는 휘날리는 후와게의 달리는 모션입니다. 그런데 실제로 화면에는 의도와 달리 움직임이 어색하고 모션이 등장하지 않아 실제 사용까지 성공에 도달하지는 못했습니다)


5. 그래서 어떤 방식으로 시작하면 될까요

두 번 만들어본 뒤에는 캐릭터를 보기 전에 먼저 세 가지를 적어보는 편이 좋다고 생각하게 됐습니다.

  1. 딱 봐도 이 캐릭터가 맞다고 느끼게 하는 특징은 무엇인가?

  2. 그 특징은 방향이 바뀌어도 같은 위치에 있어야 하는가?

  3. 나는 움직이는 전체 결과를 먼저 보고 싶은가, 얼굴 기준을 먼저 정하고 싶은가?

다음과 같은 경우에는 /hatch부터 시작해볼 만합니다.

  • 움직이는 Hermes 펫이 어떤 것인지 먼저 경험하고 싶다.

  • 캐릭터가 단순하고 좌우대칭에 가깝다.

  • 생성된 후보를 보면서 취향을 구체화하고 싶다.

  • 첫 결과를 빨리 확인하는 것이 중요하다.

반대로 다음과 같은 경우에는 정면 기준 이미지를 먼저 만드는 편이 나았습니다.

  • 반드시 닮아야 하는 기존 인물이나 캐릭터가 있다.

  • 한쪽으로 흐르는 머리, 흉터, 안대, 귀걸이처럼 방향이 중요한 특징이 있다.

  • 이것이 바뀌면 다른 캐릭터라고 느끼는 요소를 설명할 수 있다.

  • 빠른 첫 결과보다 외형의 일관성이 중요하다.

그리고 어느 방식을 고르든 마지막에는 실제 Hermes 화면에서 확인해야 합니다.

  • [ ] 정면뿐 아니라 옆면과 뒷면도 같은 부피로 보이는가

  • [ ] 달리기와 점프가 작은 크기에서도 동작으로 읽히는가

  • [ ] 머리, 흉터, 장식 같은 비대칭 특징이 뒤집히지 않는가

  • [ ] 검은 픽셀, 흰 테두리와 배경 조각이 남지 않았는가

  • [ ] 이미지 파일과 실제 표시 크기에서 같은 캐릭터로 보이는가

/hatch와 정면 이미지의 차이는 움직이는 결과를 먼저 보고 기준을 찾을지, 기준을 먼저 정하고 움직임을 확장할지의 차이였습니다.

저는 후와고를 먼저 태어나게 했고, 후와게는 증명사진부터 찍었습니다. 둘 다 결국 움직였고, 둘 다 움직이기 시작한 뒤 새로운 문제가 보였습니다.

특히 후와게는 왼쪽과 오른쪽으로 달리는 그림을 따로 만든 후 펫을 생성했는데, 실제 Hermes 화면에서 앞머리가 반대쪽으로 넘어가는 현상이 발생했습니다.

그 문제는 단순히 스프라이트를 고쳐서 해결할 일이 아니었습니다.

다음 글에서는 정상적으로 만든 방향별 이미지가 실제 화면에서 다시 뒤집힌 이유를 정리해보려고 합니다.

3
4개의 답글
밀어주고 끌어주는

온·오프라인 AI 스터디

AI로 어디까지 할 수 있는지
직접 확인하실 분만 신청하세요.