# 챗지피티를 이용하여 스토리보드 만들고, 그록을 이용하여 AI 영상 제작하기
## 📝 한줄 요약
ChatGPT로 「루이의 하루」 60초 스토리보드를 구성하고, Grok에서 영상을 생성할 수 있도록 제작 자료와 프롬프트를 정리했다.
## 🎯 이런 분들께 도움돼요
- 사진을 바탕으로 짧은 AI 영상을 만들어보고 싶은 분
- 막연한 아이디어는 있지만 장면 구성과 영상 프롬프트 작성이 어려운 분
- AI가 만든 캐릭터의 외형이 장면마다 달라져 고민인 분
## 😫 문제 상황 (Before)
루이가 유치원에 갔다가 집으로 돌아오는 하루를 60초 영상으로 만들기로 했다. 바로 영상을 생성하기보다는 먼저 전체 이야기와 장면 순서를 정리할 필요가 있었다.
영상의 흐름은 집에서 출발해 유치원에서 시간을 보내고 보호자와 다시 만나는 과정으로 잡았다. 각 장면이 자연스럽게 이어지도록 루이의 행동과 상태 변화도 함께 정리했다.
처음의 요청을 한 문장으로 정리하면 이랬다.
루이가 유치원에 가서 하루를 보내고 다시 보호자를 만나는 과정을,
루이의 감정이 느껴지는 60초짜리 시네마틱 영상으로 만들고 싶어.
그러나 바로 영상을 생성하면 몇 가지 문제가 생길 가능성이 컸다.
- 장면마다 루이의 얼굴과 털 무늬가 달라질 수 있다.
- 강아지의 감정을 사람처럼 웃고 우는 표정으로 과장할 수 있다.
- 60초 분량을 한 번에 만들다가 이야기와 외형의 연속성이 무너질 수 있다.
- 정지 이미지에 줌과 이동 효과만 넣은 결과물이 “완성 영상”처럼 보일 수 있다.
그래서 영상 생성에 앞서 이야기, 캐릭터, 공간, 카메라와 동작을 먼저 설계하기로 했다.
## 🛠️ 사용한 도구와 자료
- **ChatGPT**: 시나리오 구성, 캐릭터 기준, 장면별 스토리보드와 제작 명세 정리
- 사용 모델 버전은 인계 자료에 기록되지 않아 특정하지 않았다.
- **Grok**: 16개 스토리보드를 4개의 15초 구간으로 나눠 동적 영상을 생성하기 위한 도구
- 영상 생성 프롬프트까지 준비했으며 최종 동적 영상 생성은 다음 단계다.
- **루이 실제 사진 12장**: 얼굴 무늬, 귀, 체형, 털과 표정의 기준휴대폰 케이스에 담긴 개 사진 모음
- **캐릭터 마스터 시트 1장**: 루이의 정면·측면·후면, 표정과 자세 규칙 정리
- **세계관 레퍼런스 시트 1장**: 집, 자동차, 유치원과 귀가 장면의 색감·조명 통일
- **스토리보드 프레임 16장**: 60초 영상의 사건 순서와 화면 구도
- **60초 애니매틱 2개**: 장면 순서와 전체 호흡을 확인하기 위한 참고본
애니매틱은 1280×720, 30fps, 60초로 만들어졌지만 정지 이미지에 움직임을 준 검토용 영상이다. 최종 동적 생성 영상은 아직 다음 제작 단계로 남아 있다.
## 🔧 작업 과정
### 1. 전체 이야기의 흐름을 먼저 정했다
먼저 60초 동안 어떤 순서로 이야기가 진행될지 정하고, 각 구간에서 보여줄 상태를 아홉 단계로 나눴다.
**편안함 → 기대와 설렘 → 작은 긴장 → 탐색 → 호기심 → 즐거움 → 피로와 기다림 → 재회의 기쁨 → 안도감**
이 순서를 기준으로 집, 자동차, 유치원, 귀가 장면을 배치했다.
### 2. 상태 변화를 구체적인 행동으로 정리했다
AI 영상에서 표정이 과장되는 것을 줄이기 위해 각 상태를 구체적인 행동과 연결했다.
| 감정 | 화면에 나타나는 행동 |
|---|---|
| 기대 | 귀가 앞으로 향하고 꼬리 끝부터 흔들린다 |
| 긴장 | 걸음을 멈추고 몸을 낮추며 귀를 뒤로 향한다 |
| 호기심 | 코를 내밀고 냄새를 맡으며 천천히 접근한다 |
| 즐거움 | 꼬리를 높이고 가볍게 달리거나 공을 따라간다 |
| 기다림 | 출입문을 바라보다 턱을 앞발 위에 놓는다 |
| 반가움 | 몸을 빠르게 일으켜 보호자에게 곧게 달려간다 |
| 안도 | 보호자의 손에 머리를 기대고 눈을 천천히 감는다 |
이 기준은 장면별 이미지와 영상 프롬프트에 공통으로 사용했다.
### 3. 실제 사진을 기준으로 외형 기준을 정했다
가장 중요한 과제는 16개 장면에 같은 루이가 계속 등장하도록 만드는 것이었다.
실제 사진 12장을 바탕으로 다음 특징을 고정했다.
- 흰색과 크림색 중심의 풍성한 장모
- 양쪽 귀의 브라운그레이 털
- 왼쪽 눈 주변이 더 넓고 진한 비대칭 무늬
- 작은 삼각형 귀와 짧은 주둥이
- 실제 비율의 검고 둥근 눈
- 짧은 다리와 둥글고 풍성한 체형
- 풍성하게 말린 꼬리
자료가 서로 다르게 보일 때 적용할 우선순위도 정했다.
1. 실제 루이 사진
2. 글로 정리한 고정 디자인 규칙
3. 캐릭터 마스터 시트
4. 스토리보드
5. 초기 콘셉트 이미지
생성 이미지와 실제 사진이 다를 경우에는 실제 사진을 우선하도록 했다.
### 4. 60초 이야기를 네 구간과 16개 장면으로 나눴다
한 번에 60초를 생성하는 대신, 이야기 전체를 15초씩 네 구간으로 나눴다.
| 구간 | 시간 | 이야기 |
|---|---:|---|
| A | 0:00–0:15 | 집에서 가방 소리를 듣고 현관을 나서는 기대 |
| B | 0:15–0:30 | 자동차 이동과 유치원 입구에서 느끼는 작은 긴장 |
| C | 0:30–0:45 | 친구를 탐색하고 놀다가 보호자를 기다리는 시간 |
| D | 0:45–1:00 | 익숙한 발소리, 재회, 귀가하며 느끼는 안도 |
각 구간은 다시 4개의 장면으로 나뉘었다. 총 16개 장면마다 시간, 행동, 카메라 위치와 감정을 지정했다.
예를 들어 첫 15초에는 다음 네 장면이 들어간다.
1. 침대에 엎드린 루이가 보호자의 움직임을 관찰한다.
2. 유치원 가방의 지퍼 소리에 귀가 움직인다.
3. 보호자가 하네스를 채우자 현관을 바라본다.
4. 문이 열리면 잠시 멈춘 뒤 문턱을 넘는다.
단순한 컷 목록이 아니라 “한쪽 귀가 먼저 움직인다”, “가방과 얼굴 사이에서 초점이 이동한다”, “루이 눈높이에서 천천히 전진한다”처럼 실제 촬영 지시까지 포함했다.
### 5. 공간과 조명도 감정선에 맞춰 고정했다
장면마다 배경 스타일이 바뀌면 한 편의 영상처럼 느껴지지 않는다. 그래서 장소별 색과 빛의 역할을 미리 정했다.
- 집: 크림과 베이지, 부드러운 아침 햇살
- 이동: 현실적인 회색과 창밖 자연광
- 유치원: 아이보리와 우드, 절제된 파스텔
- 기다림: 채도와 밝기를 조금 낮춘 창가 측면광
- 재회와 귀가: 따뜻한 골든아워와 부드러운 역광
카메라는 대부분 루이의 눈 또는 가슴 높이에 두었다. 보호자는 손, 다리, 발걸음과 실루엣 위주로 표현하도록 정리했다.
### 6. 16개 프레임과 60초 애니매틱으로 흐름을 검토했다
설계를 바탕으로 16개의 개별 스토리보드 프레임과 4×4 보드를 만들었다. 이어서 전체 장면의 순서와 호흡을 확인하기 위한 60초 애니매틱도 제작했다.
애니매틱은 영상 파일이지만 정지 이미지에 줌과 패닝을 적용한 검토용 결과물이다.
최종 결과물은 귀 움직임, 고개 돌리기, 걷기, 달리기와 같은 동작이 실제로 생성된 영상이다. 따라서 애니매틱은 장면 순서와 길이를 확인하는 중간 결과물로 구분했다.
## ⚠️ 작업 중 발견한 문제와 해결
### 생성 이미지에서 외형이 달라지는 문제
초기 콘셉트 이미지에서는 루이의 비대칭 얼굴 무늬가 좌우 대칭에 가깝게 정리되고, 눈과 얼굴이 더 둥글고 인형처럼 표현되는 경향이 나타났다.
이를 줄이기 위해 왼쪽 눈 주변의 무늬, 실제 눈 크기, 귀의 위치와 체형을 명시하고 원본 사진을 최우선 자료로 지정했다.
### 장면마다 다른 강아지처럼 보일 수 있는 문제
단일 스토리보드 이미지만으로 다음 장면을 만들면 외형이 조금씩 변할 수 있다. 그래서 한 장의 생성 이미지를 정답으로 삼지 않고 여러 실제 사진과 캐릭터 시트를 함께 참조하도록 했다.
최종 영상 제작 단계에서도 각 15초 구간의 마지막 프레임을 다음 구간의 연속성 기준으로 재사용하도록 계획했다.
### 슬라이드쇼가 완성 영상처럼 보이는 문제
정지 이미지에 카메라 이동 효과를 적용한 MP4는 실제 동작이 생성된 영상과 구분할 필요가 있었다.
그래서 합격 기준에 다음 항목을 명시했다.
- 정지 이미지 슬라이드쇼 금지
- 단순 줌·패닝과 켄 번즈 효과 금지
- 장면 사이 녹아내림과 형태 변형 금지
- 각 장면에 한두 개의 명확하고 자연스러운 동작 포함
- 네 개의 15초 동적 영상이 승인된 뒤 60초로 조립
## ✅ 결과 (After)
| Before | After |
|---|---|
| “루이의 유치원 하루를 영상으로 만들고 싶다”는 아이디어 | 작품의 핵심 문장과 9단계 감정선 확정 |
| 시작·등원·놀이·귀가 정도의 막연한 줄거리 | 초 단위 시간이 지정된 16개 장면 |
| 장면마다 외형이 달라질 위험 | 실제 사진 12장을 이용한 외형 기준 |
| 감정을 사람 표정처럼 과장할 위험 | 귀·시선·꼬리·자세 중심의 행동 규칙 |
| 한 번에 60초를 생성하려는 접근 | 15초 단위 4개 구간 제작과 연속성 유지 방식 |
| 영상 파일이면 완성이라고 판단하기 쉬움 | 애니매틱과 실제 동적 영상의 합격 기준 분리 |
현재까지 완성된 산출물은 다음과 같다.
- 60초 서술형 시나리오 1개
- 감정 흐름 9단계
- 루이 캐릭터 마스터 시트 1장
- 세계관 레퍼런스 시트 1장
- 개별 스토리보드 16장
- 통합 스토리보드 보드 3장
- 60초 검토용 애니매틱 2개
- 15초 단위 4구간 영상 제작 명세와 생성 프롬프트개 침대에 있는 개 사진 콜라주
아직 남은 단계도 분명하다. 네 구간을 실제 이미지-투-비디오 방식으로 생성하고, 루이의 외형과 동작 연속성을 검수한 뒤 사운드와 음악을 더해 최종 60초 영상을 완성해야 한다.
## 💬 AI 활용 팁
1. **장면보다 감정선을 먼저 정하세요.**
감정의 변화가 있어야 평범한 일상도 이야기가 된다.
2. **“귀엽게”보다 관찰 가능한 특징을 적으세요.**
얼굴 무늬의 위치, 귀의 크기, 눈의 비율처럼 확인 가능한 기준이 캐릭터 일관성에 더 효과적이다.
3. **원본 자료의 우선순위를 정하세요.**
실제 사진과 생성 이미지가 충돌할 때 무엇을 따를지 미리 정해야 AI가 만든 결과에 끌려가지 않는다.
4. **감정을 실제 행동으로 바꾸세요.**
“불안해 보인다”보다 “멈추고 몸을 낮추며 귀를 뒤로 향한다”가 영상 생성에 적합하다.
5. **긴 영상은 짧은 구간으로 나누세요.**
60초를 한 번에 만들기보다 15초씩 만들고 마지막 프레임을 이어 쓰는 편이 외형과 공간의 연속성을 관리하기 쉽다.
6. **중간 결과와 최종 결과의 기준을 구분하세요.**
스토리보드와 애니매틱은 충분히 가치 있는 산출물이지만, 실제 동작 영상과는 역할이 다르다.
## 📋 재사용 가능한 프롬프트
> 내 반려동물의 실제 사진을 바탕으로 60초 분량의 시네마틱 일상 영상을 기획해줘.
> 먼저 이 이야기의 핵심 감정과 감정 변화 순서를 정하고, 감정을 사람 같은 표정이 아니라 귀·시선·꼬리·자세·걸음 등 실제 동물 행동으로 번역해줘.
> 실제 사진에서 외형의 고정 특징과 비대칭 요소를 찾아 캐릭터 규칙을 만들고, 원본 사진을 모든 생성 이미지보다 우선하도록 해줘.
> 이야기를 15초씩 4개 구간, 총 16개 장면으로 나눠 각 장면의 시간, 행동, 카메라, 조명과 감정을 표로 작성해줘.
> 정지 이미지 슬라이드쇼나 단순 줌·패닝이 아니라 실제 동작이 생성되는 영상을 목표로 하고, 스토리보드·애니매틱·최종 영상의 합격 기준을 각각 구분해줘.
## 🚀 다음 단계
다음 작업은 스토리보드 01–04, 05–08, 09–12, 13–16을 각각 15초짜리 실제 동적 영상으로 생성하는 것이다. 각 구간에서 루이의 얼굴 무늬와 체형, 친구 강아지, 공간과 조명이 유지되는지 먼저 검수하고, 네 구간이 승인된 뒤에만 하나의 60초 영상으로 합친다.
사운드는 영상 연속성이 확정된 다음 더한다. 가방 지퍼, 하네스 버클, 현관문, 자동차의 낮은 주행음, 발소리와 공 굴러가는 소리를 중심으로 구성하고, 음악은 부드러운 피아노와 절제된 앰비언트 톤을 사용한다.
현재는 스토리보드와 제작 기준까지 정리된 상태다. 다음 단계에서 Grok으로 15초 영상 4개를 생성하고, 검수 후 60초 영상으로 합칠 예정이다.
** Grok에서 16장의 사진을 한꺼번에 올려 비디오 만드는것을 지원하지 않아서 방법을 연구하고 있습니다.
** 드디어 완료 - [영상보러가기]
https://claude.ai/code/artifact/eddd8a4a-4036-4a22-abfe-e685ab64808c