AI 영상 제작: 아이디어에서 제작 파이프라인까지
어린이 엘리베이터 안전송 기획의 교훈
AI 영상 제작을 시작할 때 가장 어려운 점은 프롬프트를 잘 쓰는 것이 아니었습니다.
오히려 더 어려웠던 것은 어떤 순서로 무엇을 결정 해야 하는지, 그리고 이미지·영상·음악을 어떻게 하나의 제작 흐름으로 연결할지였습니다.
이번에는 어린이를 위한 엘리베이터 안전교육 동요를 기반으로, 마루와 루미라는 캐릭터가 등장하는 약 1분 분량의 AI 애니메이션을 기획하고 제작하는 과정을 진행했습니다.
단순히 “영상 하나를 만들어보자”는 수준에서 시작했지만, 작업을 이어가면서 자연스럽게 다음과 같은 제작 체계가 만들어졌습니다.
작품 방향 설정 → 서술형 시나리오 → 스토리보드 → SHOT 분리 → 이미지 생성 → Google Flow 영상화 → 편집 및 음악 싱크
이 글에서는 실제 작업 순서와 시행착오, 그리고 AI 영상 제작에서 특히 중요했던 판단들을 정리해보겠습니다.
영상의 핵심 방향 정리
처음부터 장면이나 프롬프트를 만들지 않고, 작품이 시청자에게 어떤 감정과 경험을 줄 것인지부터 정리했습니다.
이번 영상의 기본 아이디어는 다음과 같았습니다.
주제: 어린이를 위한 엘리베이터 안전약속
주인공: 흰색 강아지 마루와 회색 줄무늬 고양이 루미
배경: 백화점 전망용 엘리베이터
핵심 감정: 호기심과 교훈
전체 분위기: 밝고 재미있는 어린이 안전교육
주요 관전 포인트: 안전수칙을 지키지 않는 장면과 올바른 행동으로 바뀌는 과정
이를 바탕으로 작품 방향을 다음과 같이 정리했습니다.
항목
내용
핵심 감정
호기심을 느끼다가 위험 행동을 보고 ‘아차’ 하는 교훈을 얻는 감정
핵심 경험
마루와 루미를 따라 엘리베이터 안전수칙을 체험하듯 배우는 영상
장르
어린이 안전교육 뮤직비디오형 3D 애니메이션
핵심 콘셉트
마루와 루미가 잘못된 행동을 경험하고 올바른 안전약속을 배우는 이야기
관전 포인트
위험 행동과 올바른 행동의 비교, 캐릭터의 표정과 반응 변화
이 단계를 먼저 진행하니 이후 시나리오와 스토리보드의 방향이 흔들리지 않았습니다.
동요 길이에 맞춘 시나리오 설계
첨부한 엘리베이터 안전송의 길이는 약 1분 정도였습니다.
일반적인 영상 시나리오처럼 긴 이야기를 쓰기보다는, 나중에 AI 영상툴이 이해할 수 있도록 다음 요소를 중심으로 작성했습니다.
장소
캐릭터 행동
행동의 원인과 결과
표정과 감정 변화
카메라 구도
다음 장면으로 연결되는 종료 이미지
전체 흐름은 다음과 같이 구성했습니다.
도입
백화점 전망용 엘리베이터에 도착한 마루와 루미가 안전 지킴이 포즈를 취합니다.
위험 행동
마루가 문에 기대거나 엘리베이터 안에서 뛰려 합니다.
위험 발견
루미가 이를 발견하고 큰 손동작으로 멈추게 합니다.
비상 상황
엘리베이터가 멈추자 두 캐릭터가 놀라지만, 숨을 고르고 비상벨을 누릅니다.
안전 행동
승강기 고유번호를 확인하고, 화재 상황에서는 엘리베이터 대신 계단으로 이동합니다.
결말
마루와 루미가 안전 지킴이 배지를 얻고 자신감 있게 포즈를 취합니다.
여기서 중요한 원칙은 모든 장면을 다음 구조로 단순화한 것이었습니다.
잘못된 행동 → 위험 신호 → 행동 중지 → 올바른 행동
이 구조는 어린이에게도 이해하기 쉽고, AI 영상툴에도 비교적 명확하게 전달됩니다.
1분 영상을 16개의 SHOT으로 분리
처음에는 약 15초 단위의 큰 CUT으로 구성했지만, 실제 AI 영상 제작을 위해서는 더 짧은 SHOT 단위가 필요했습니다.
그래서 약 1분의 영상을 총 16개 SHOT으로 나눴습니다.
SHOT
주요 장면
SH01
백화점 아트리움과 전망용 엘리베이터 등장
SH02
마루와 루미의 안전 지킴이 포즈
SH03
엘리베이터 탑승
SH04
문에 기대지 않기
SH05
상승 중 신난 마루
SH06
엘리베이터 안에서 뛰지 않기
SH07
내리기 전 멈추기
SH08
바닥 높이 확인하기
SH09
갑자기 멈춘 엘리베이터
SH10
당황하지 않고 숨 고르기
SH11
비상벨 누르기
SH12
침착하게 기다리기
SH13
승강기 고유번호 확인 하기
SH14
안전하게 내리기
SH15
불이 나면 계단 이용하기
SH16
안전 지킴이 완성
이렇게 나누니 각 SHOT마다 한 가지 행동만 넣을 수 있었습니다.
AI 영상 생성에서는 한 장면 안에 여러 행동을 넣을수록 결과가 불안정해집니다. 예를 들어 한 SHOT 안에서 캐릭터가 뛰고, 문이 열리고, 넘어지고, 다시 일어나는 장면까지 모두 지시하면 동작이 섞이거나 생략될 가능성이 높습니다.
따라서 이번 작업에서는 다음 원칙을 유지했습니다.
한 SHOT에는 하나의 핵심 행동만 넣는다.
4×4 스토리보드 제작
16개의 SHOT을 한눈에 보기 위해 4×4 형태의 스토리보드 카드로 구성했습니다.
스토리보드에는 다음 요소를 포함했습니다.
SHOT 번호
시작 및 종료 시간
장면 이미지
장면 설명
안전수칙
한 화면에 전체 흐름이 보이니 몇 가지 문제가 바로 드러났습니다.
캐릭터 위치가 장면마다 달라지는 문제
엘리베이터 내부 구조가 바뀌는 문제
일부 장면에서 마루와 루미의 역할이 뒤바뀌는 문제
장면 설명과 이미지의 동작이 일치하지 않는 문제
스토리보드는 단순한 그림 모음이 아니라, 영상 전체의 연속성을 검토하는 도구라는 점을 확인할 수 있었습니다.
이미지 수정 과정의 시행착오
스토리보드가 완성된 뒤 숫자와 글자를 제거해달라고 요청했습니다.
원했던 것은 기존 4×4 스토리보드에서 다음 요소만 지우는 것이었습니다.
SH01~SH16 번호
시간 표시
장면 설명 문구
상단 제목
하지만 이미지 편집 요청이 정확하게 전달되지 않아, 기존 이미지에서 글자만 지운 것이 아니라 전혀 다른 캐릭터와 장면으로 새로운 스토리보드가 생성되는 문제가 발생했습니다.
이 경험을 통해 이미지 편집 프롬프트에서는 다음과 같이 매우 구체적으로 지시해야 한다는 점을 배웠습니다.
첨부한 원본 이미지를 수정한다.
캐릭터, 배경, 구도, 소품, 조명, 4×4 패널 배치를 모두 그대로 유지한다.
이미지 안의 모든 숫자와 글자만 제거한다.
새로운 캐릭터나 장면을 생성하지 않는다.
빈 공간은 주변 배경과 동일하게 자연스럽게 복원한다.
특히 “글자를 지워달라”는 요청만으로는 AI가 편집이 아닌 재생성으로 해석할 수 있습니다.
따라서 이미지 편집에서는 반드시 다음 세 요소를 함께 적는 것이 좋습니다.
무엇을 유지할 것인가
무엇만 제거할 것인가
무엇을 새로 만들면 안 되는가
Google Flow용 프롬프트 작성
SHOT별 이미지를 만든 뒤 Google Flow에서 영상으로 생성하기 위한 프롬프트를 작성했습니다.
일반적인 텍스트 투 비디오 프롬프트라면 캐릭터 외형과 배경을 자세히 설명해야 하지만, 이미 완성된 스토리보드 이미지를 시작 프레임으로 사용하는 경우에는 접근 방식이 달라야 했습니다.
이미지에 캐릭터와 배경이 있기 때문에 다음 항목을 중심으로 작성했습니다.
원본 이미지 유지
한 가지 행동
카메라 방향
동작 완료 시점
금지 요소
예를 들어 비상벨을 누르는 SH11은 다음과 같이 구성했습니다.
루미가 엘리베이터 조작반의 비상벨 버튼을 손가락으로 가리킨다. 마루가 버튼을 확인한 뒤 검지손가락으로 비상벨 버튼을 한 번 정확하게 누른다. 버튼을 누르는 순간 버튼 둘레의 불빛이 켜진다. 마루는 손을 버튼에서 떼고 루미를 바라본다. 루미는 고개를 끄덕인다. 카메라는 조작반 쪽으로 천천히 전진하며 손과 버튼을 크게 보여준다.
그리고 다음과 같은 금지 요소를 추가했습니다.
여러 버튼 누르기, 손가락 변형, 버튼 위치 변경, 숫자 새로 생성, 조작반 형태 변화 금지.
이 금지 요소가 의외로 중요했습니다. AI는 지시한 행동뿐만 아니라 장면을 그럴듯하게 만들기 위해 임의의 요소를 추가하기도 하기 때문입니다.
엘리베이터 장면의 물리적 순서 명확화
엘리베이터 영상에서 특히 중요한 문제가 있었습니다.
AI가 엘리베이터의 운행 상태와 문 움직임을 현실적으로 이해하지 못하면 다음과 같은 오류가 발생할 수 있습니다.
엘리베이터가 움직이는 중에 문이 열림