AI 영상 제작의 시작과 목표
AI 영상 제작의 배경과 동기
이번 프로젝트는 제 삶의 여러 시기를 단순한 경력 소개가 아니라 “공간을 꿈꾸던 사람이 다른 길을 돌아 다시 공간으로 향하는 이야기”로 보여주는 AI 영상 제작입니다. 스무 살 때 작은 식당을 꿈꿨던 일, 9년 동안 집의 식탁으로 사람들을 초대한 경험, 팝업 다이닝과 콘텐츠 촬영, 전세사기로 공간을 잃은 일, 회계·재무 경력과 창업 도전, 그리고 책·음식·문화·사람이 연결되는 OTD코퍼레이션을 만난 현재까지를 1분 42초 안에 담고 싶었습니다. 이력서처럼 사건을 나열하면 서로 달라 보이는 경험들이지만, 영상으로 연결해 보니 모든 경험의 중심에는 계속 사람과 공간이 있었습니다. 그래서 첫 출근을 앞두고 “나는 꿈을 포기한 것이 아니라, 그 꿈으로 돌아가기 위한 다른 길을 걷고 있었다”는 메시지를 전달하는 것을 목표로 삼았습니다.
한 무리의 사람들이 테이블 주위에 앉아 와인을 마시고 있다
AI 영상 제작 과정
사용한 도구와 활용 방법
- 대화형 AI: 긴 개인 서사를 18개의 짧은 내레이션 단위로 정리하고, 장면별 이미지·영상 제작 지시문을 구성했습니다.
- AI 이미지 생성 도구: 이야기의 시간 순서에 맞춰 16:9 스토리보드 이미지 16장을 만들었습니다. 주인공의 짧은 검은 머리와 따뜻한 3D 애니메이션 톤을 반복해 사용했습니다.
- AI 영상 생성 도구: 각 스토리보드 이미지를 짧은 영상 클립으로 변환했습니다.
- 음성·음악 제작 도구: 내레이션과 배경음악을 준비했습니다. 음악은 MP3와 WAV로, 내레이션은 MP3로 각각 관리했습니다.
- CapCut: 17개의 영상 클립을 순서대로 배치하고 내레이션, OST, 한국어 자막, 전환과 타이밍을 맞춰 1차 초안을 완성했습니다.
- Codex와 GitHub: 16:9·9:16 스토리보드, 영상 클립, OST, 내레이션, SRT 자막을 폴더별로 정리하고 버전을 기록했습니다.
전체 작업 흐름
개인 경험에서 핵심 사건 추출
→ “공간”이라는 하나의 주제로 서사 재구성
→ 1분 42초 내레이션 작성
→ 6초 단위 장면 설계
→ 16:9 스토리보드 16장 생성
→ 이미지별 짧은 영상 클립 생성
→ 내레이션·OST·SRT 자막 준비
→ CapCut 타임라인에서 영상·음성·자막 조립
→ 1차 초안 검토
→ GitHub에 제작 자산과 버전 기록
프롬프트 전문
아래프롬프트는 기존까지 AI와 대화한 내용들을 재구성하여 작성한 내용입니다.
개인 서사를 영상 내레이션으로 구성하는 프롬프트
너는 감성 브랜드 필름과 자기소개 영상의 시나리오 작가다.
아래 개인 경험을 바탕으로 1분 42초 분량의 한국어 내레이션을 작성해 줘.
영상은 OTD 첫 출근을 앞둔 한 사람의 자기소개이자,
서로 달라 보였던 경험들이 결국 하나의 꿈으로 이어졌음을 보여주는 이야기다.
[핵심 경험]
- 스무 살 때 사람들을 이어주는 작은 식당을 꿈꿈
- 당장 식당을 열 수 없어 집의 작은 식탁으로 사람들을 초대함
- 9년 동안 천 명에 가까운 사람들과 추억을 만듦
- 요리사들과 팝업 다이닝에 도전함
- 요리 촬영, 음식 연출, 공간 콘텐츠 제작을 경험함
- 외국인 여성 게스트에게 한국의 집밥과 따뜻한 일상을 나눔
- 첫 게스트와의 인연이 오래 이어지는 우정이 됨
- 전세사기로 공간을 잃고 소송과 경매를 겪음
- 꿈을 잠시 접고 회계와 재무 분야에서 경력을 쌓음
- AI 시대에 앱과 캐릭터 IP 창업에 도전함
- 개발, 디자인, 홍보, 고객 응대, 운영을 혼자 감당함
- 실패 경험을 무대에서 솔직하게 발표해 1등을 함
- 경력 공백 이후 재취업의 어려움을 겪음
- 책, 음식, 문화, 사람이 공간으로 연결되는 OTD를 만남
- 회계와 재무 역량으로 의미 있는 공간의 지속 가능성을 돕고 싶음
[구성 규칙]
1. 전체를 18개의 자막 블록으로 나눈다.
2. 1~16번은 각 6초, 17~18번은 각 3초 분량으로 작성한다.
3. 한 블록은 화면에서 읽기 쉬운 1~2문장으로 쓴다.
4. 과장하거나 새로운 사실을 만들지 않는다.
5. 따뜻한 시작 → 상실과 우회 → 새로운 도전 → OTD에서의 귀환 순서로 구성한다.
6. 마지막은 아래 의미가 남도록 마무리한다.
“나는 꿈을 포기한 것이 아니었다.
그 꿈으로 돌아가기 위한 다른 길을 걷고 있었을 뿐이다.”
7. 결과는 번호, 시작 시각, 종료 시각, 내레이션을 포함한 표로 출력한다.
장면별 스토리보드 이미지를 만드는 프롬프트
너는 감성 3D 애니메이션 영화의 스토리보드 아티스트다.
아래 내레이션을 설명하는 16:9 시네마틱 장면 한 컷을 제작한다.
[주인공 고정]
- 한국인 여성
- 성인, 짧은 검은색 단발머리
- 부드럽고 진솔한 인상, 큰 갈색 눈
- 장면의 시대와 상황에 맞는 단정하고 자연스러운 옷차림
- 모든 장면에서 동일 인물로 알아볼 수 있는 얼굴과 헤어스타일 유지
[비주얼 스타일 고정]
- warm cinematic 3D animated film style
- expressive but natural facial emotion
- detailed environment storytelling
- soft cinematic lighting
- warm amber and brown palette for memories and human connection
- cool blue-gray palette for loss, uncertainty, and career struggle
- return to warm light in the final OTD scene
- 16:9 horizontal composition
- no logo, no watermark, no random text, no UI unless the scene requires it
[이번 장면]
내레이션: [해당 장면의 내레이션 입력]
장소: [장소 입력]
행동: [주인공과 주변 인물의 행동 입력]
감정: [장면의 핵심 감정 입력]
상징 오브젝트: [식탁, 음식, 사진, 달력, 서류, 노트북, 책장 등 입력]
[연출 규칙]
- 내레이션의 의미가 자막 없이도 전달되게 한다.
- 한 장면에 사건을 너무 많이 넣지 않는다.
- 주인공의 표정과 공간의 변화가 감정을 설명하게 한다.
- 이전 장면과 같은 캐릭터와 렌더링 스타일을 유지한다.
- 이미지 안에 읽을 수 없는 글자를 생성하지 않는다.
스토리보드를 영상 클립으로 바꾸는 프롬프트
Create a 6-second cinematic animation from this storyboard image.
Preserve the main character's face, short black bob hairstyle, clothing,
environment, lighting, color palette, and the original 16:9 composition.
Use subtle, emotionally appropriate motion:
- natural blinking and breathing
- small head and hand movements
- gentle movement from nearby people or objects
- slow cinematic camera push-in or slight lateral movement
- stable anatomy and consistent facial identity
The motion must support the scene's emotion without changing the story.
Do not add new characters, objects, text, logos, subtitles, or watermarks.
Avoid face morphing, extra fingers, warped objects, sudden camera movement,
lip-sync artifacts, flicker, and style changes.
Scene narration:
[해당 장면의 내레이션 입력]
Scene emotion:
[따뜻함 / 설렘 / 상실 / 불안 / 도전 / 회복 중 하나 입력]
CapCut 편집 방법
생성한 영상 클립을 이야기 순서대로 타임라인에 배치했습니다.
대부분의 장면은 6초, 마지막 두 문장은 3초 단위로 맞췄습니다.
내레이션을 먼저 기준 트랙으로 두고, 영상의 시작과 끝을 음성에 맞췄습니다.
배경음악은 내레이션을 가리지 않도록 낮게 깔고 감정 전환 구간을 확인했습니다.
SRT 자막을 불러온 뒤 화면 하단의 안전 영역과 가독성을 확인했습니다.
따뜻한 기억, 상실, 도전, OTD와의 만남이 색감과 장면 전환에서도 구분되도록 배열했습니다.
1차 초안을 출력한 뒤 자막, 인물 일관성, 장면 호흡을 다시 검토했습니다.
활용 이미지와 1차 초안 캡처
작은 식탁에서 시작한 꿈
한국의 집밥을 나눈 공간
한 무리의 사람들이 테이블 주위에 앉아 와인을 마시고 있다
한 소녀가 테이블 앞에 음식을 앞에 두고 서 있습니다.
공간을 잃은 시간
실패를 솔직하게 말한 도전
한 소녀가 많은 서류를 들고 복도에 앉아 있다
만화 속 여자가 마이크 앞에서 한 무리의 사람들에게 말하고 있다
AI 영상 제작의 결과
최종 영상 결과물링크: https://youtu.be/sWgox2tUp7o?si=UyH3qzqhlmgmyqtn
썸네일은 유튜브에서 AI로 만들수있는 서비스가 있어서 간단히 생성했습니다.
- 18개의 내레이션 블록과 16개의 주요 장면으로 1분 42초짜리 1차 초안을 완성했습니다.
- 개인적인 기억, 위기, 경력 전환, 새로운 출발을 “공간”이라는 하나의 주제로 연결했습니다.
- 16:9 스토리보드 16장, 영상 클립 17개, 내레이션과 OST, 한국어 SRT 자막을 각각 분리해 관리했습니다.
- 제작 자산을 GitHub에 종류별 폴더로 저장해 다음 편집에서도 원본을 다시 찾기 쉽게 만들었습니다.
배운 점과 꿀팁
먼저 한 문장짜리 중심축을 정해야 합니다.
이번 영상의 중심축은 “꿈을 포기한 것이 아니라 돌아가기 위한 다른 길을 걸었다”였습니다. 이 문장이 있으니 어떤 경험을 남기고 덜어낼지 판단하기 쉬웠습니다.
내레이션을 먼저 시간 단위로 자르면 편집이 빨라집니다.
6초 단위로 내용을 나누니 이미지, 영상, 자막 파일이 같은 번호 체계를 가질 수 있었습니다.
감정 변화는 대사뿐 아니라 색으로도 보여줄 수 있습니다.
식탁과 사람의 기억은 따뜻한 주황빛, 공간 상실과 경력 고민은 차가운 청회색, OTD코퍼레이션 배경장면은 다시 따뜻한 빛으로 돌아오도록 구성했습니다.
AI 장면은 움직임을 크게 만들수록 깨질 가능성이 커집니다.
표정 변화, 손짓, 호흡, 느린 카메라 이동처럼 작은 움직임을 요청하는 편이 캐릭터와 배경을 안정적으로 유지하는 데 유리했습니다.
영상·음악·자막은 반드시 분리 보관합니다.
CapCut 프로젝트만 남기면 나중에 원본을 교체하기 어렵습니다. 클립, WAV/MP3, SRT, 스토리보드를 따로 보관하면 2차 편집이 훨씬 수월합니다.
1차 초안은 완성이 아니라 문제를 발견하는 도구입니다.
처음부터 모든 장면을 완벽하게 만들기보다 전체 호흡을 먼저 확인한 뒤 어색한 장면만 다시 만드는 방식이 효율적이었습니다.
시행착오와 개선점
- 장면마다 주인공의 얼굴, 눈 크기, 의상과 연령대가 조금씩 달라질 수 있었습니다.
- 여러 인물이 등장하는 장면에서는 손, 시선, 식기 같은 작은 요소가 어색하게 생성되기도 했습니다.
- 일부 배경의 글자와 문서가 의미 없는 형태로 나타났습니다. AI 이미지에서는 긴 텍스트를 만들지 않고, 필요한 글자는 편집 단계에서 넣는 편이 안전했습니다.
- 영상 클립을 먼저 길게 만든 뒤 내레이션에 맞추면 호흡이 어긋났습니다. 내레이션 시간을 먼저 확정한 뒤 클립 길이를 맞추는 방식이 더 효과적이었습니다.
- 모든 장면을 따뜻하게만 만들면 상실과 회복의 대비가 약해졌습니다. 감정이 꺾이는 구간은 조명과 색감을 의도적으로 차갑게 바꿨습니다.
- 1차 초안 캡처를 확인해 보니 장면 자체는 메시지가 잘 보이지만, 캐릭터의 세부 일관성과 일부 배경 그래픽은 2차 수정이 필요해 보였습니다.
도움이 필요한 부분
- 16개 장면에서 주인공의 얼굴과 체형을 더 정밀하게 고정하는 방법
- AI 영상 변환 과정에서 손과 얼굴 변형, 프레임 깜빡임을 줄이는 방법
- 내레이션과 배경음악의 음량을 일정하게 맞추는 믹싱 기준
- CapCut 프로젝트와 원본 자산을 장기적으로 함께 보관하는 효율적인 방법
- 1분 42초 버전에서 무엇을 덜어내면 메시지를 유지하면서 더 짧고 집중도 높게 만들 수 있을지에 대한 피드백
향후 계획
수노를 활용해 OST까지 완성한 상태인데, OST에 맞춰 기존 영상을 활용해 뮤비까지 제작해볼려합니다.
도움 받은 글
- [23기 영상파이프라인 스터디장님(천안한마당)께서 공유한 AI 영상의 캐릭터와 세계관 일관성을 잡는 제작용 레퍼런스 시트 프롬프트]
- 이전에 정리한 캐릭터 마스터 시트, 환경 앵커, 비주얼 스타일 고정 방식