소개 🚀
"면접 때 말 꼬이면 어쩌지?" 누구나 한 번쯤 걱정하죠. 모 기관에서 필수 과정 일환으로 스피치 수업을 듣던 중, 강사가 녹음 내용을 직접 손으로 전사한 뒤 평가하라길래 지금 시대에 그게 무슨소리야? 근데 Gemini 영상 분석이 괜찮잖아? 하는 생각이 들어 AI 친구들의 힘을 빌려 보기로 했어요. 🤖✨
목표: 가상의 면접 자기소개(약 1분) 녹음 → AI 분석 → 개선 포인트 찾기
왜 Gemini? 영상 분석이 1초 단위 세세한 분석으로 이미 음악 등 까지 분석해주는걸 영상 제작을 통해 경험함
결론부터 말하면: "오, 이거 1인 스피치 코치로 꽤 쓸만한데?" 라는 생각을 얻었습니다.
진행 방법 🛠️
1. 녹음 & 파일 변환 🔄
단계
내용
꿀팁
iPhone 녹음
기본 포맷 m4a 로 저장
44.1kHz 그대로 두면 음질 문제 X
포맷 변환
gpt에서 m4a오디오 > mp4비디오 변환
Gemini는 m4a 안받더라구요; 지피티에서 변환하면 희거나 검은 화면의 음성만 있는 영상이 생성됩니다.
2. Gemini 업로드 & 프롬프트 🌟
이 음성 파일의 내용을 모든 내용을 전사하고 발음, 긴 공백, 숨소리, 스읍 하는 소리 등 빠짐없이 전사해.
스피치 강사의 관점에서 습관적인 문제나 개선해야 할 부분들을 철저히 분석해줘.TIP: "모든 내용을 전사" + "발음·호흡·비언어" + "코치 시각" → 세 개 요소가 핵심 키워드였습니다.
3. Gemini가 뽑아낸 주요 피드백 📋
한국어 텍스트가있는 검은 색 화면
한국어 텍스트가있는 검은 색 화면
한국어 텍스트가있는 검은 색 화면
한국어 텍스트가있는 검은 색 화면
Gemini는 각 지적 뒤에 “트레이닝 방향”을 제시해 줍니다.
4. 추가 실험 🤓
이름 오인식 테스트: 제 이름 "육대근"을 "이태근"으로 들음 → "발음 교정 필요" 제안. 이름 하나 잘못 들으니 다른 고유명사도 재검토해 줬어요.
결과와 배운 점 💡
카테고리
인사이트
적용 계획
AI 피드백 활용
비언어 소리 제거만으로 전달력이 +20% (직접 체감)
습관어 리스트 만들어 연습 때 체크리스트화
프롬프트 디자인
요구 사항을 구체화할수록 피드백 품질 ↑
“결론→근거→예시” 구조 고정 템플릿 설계
차세대 목표
간단한 웹앱(실시간 녹음 + 분석 리포트) 프로토타입 제작
마무리 한마디 🌈
"면접 준비, 이제 혼자 거울 앞에서 끙끙대지 말고 AI한테 시원하게 털어놓으세요!"
프롬프트만 잘 다듬으면 24시간 대기 중 스피치 코치가 생깁니 다. 😎🔥