AI 영상, 일반인은 무엇부터 배워야 잘 만들 수 있을까

석은호2026.10.03 · 9분 읽기
AI 영상, 일반인은 무엇부터 배워야 잘 만들 수 있을까
이 글의 목차
  1. AI 영상은 버튼 하나로 만들어지지 않습니다
  2. 도구는 바뀝니다, 순서는 바뀌지 않습니다
  3. 첫 번째: AI 영상 기획, 글로 먼저 만드는 영상
  4. 두 번째: 프롬프트보다 먼저 영상의 말을 배우기
  5. 세 번째: 같은 인물이 계속 나오게 하려면, 재료부터
  6. 네 번째: 영상 생성, 화면비부터 정하고 여러 번 뽑기
  7. 다섯 번째: AI 영상도 결국 편집으로 완성됩니다
  8. AI가 해 주는 일, 내가 해야 하는 일
  9. 일반인이 처음부터 다 알 필요는 없습니다

AI 영상을 배우고 싶다는 분들이 가장 먼저 묻는 건 대개 도구입니다. "어떤 사이트가 제일 좋아요?", "유료로 써야 해요?", "요즘 제일 잘 나오는 게 뭐예요?"

그런데 저는 수업을 도구로 시작하지 않습니다. AI 영상을 잘 만드는 사람과 그렇지 않은 사람의 차이는, 제가 보기에 도구가 아니라 그 앞과 뒤에서 갈리기 때문입니다. 버튼을 누르기 전에 무엇을 준비했는지, 그리고 버튼을 누른 뒤에 무엇을 골라냈는지.

이 글은 일반인이 AI 영상을 배울 때 무엇을 먼저 익혀야 하는지에 대한 제 생각입니다. 조금 길지만, AI 영상을 시작하려는 분이라면 한 번은 짚고 넘어가셨으면 하는 이야기입니다.

 (AI로 생성한 이미지)

AI 영상은 버튼 하나로 만들어지지 않습니다

광고나 영상 플랫폼에서 보는 AI 영상은 정말 쉬워 보입니다. 문장 한 줄을 넣으면 그럴듯한 장면이 나옵니다. 실제로 한 장면만 놓고 보면, 지금의 AI는 놀라울 만큼 잘 만듭니다.

문제는 한 장면이 아니라 '영상'을 만들 때 생깁니다.

영상은 장면이 이어진 것입니다. 첫 장면의 주인공이 두 번째 장면에서도 같은 사람이어야 하고, 아침이었던 하늘이 갑자기 밤이 되면 안 되고, 이야기에 순서가 있어야 합니다. 장면 하나를 예쁘게 뽑는 일과, 여러 장면을 하나의 이야기로 묶는 일은 전혀 다른 일입니다.

그리고 이 두 번째 일은 아직 사람이 해야 합니다. AI 영상을 배운다는 건, 결국 이 일을 배우는 것이라고 생각합니다.

도구는 바뀝니다, 순서는 바뀌지 않습니다

지금 제가 진행하는 AI 영상 기초과정은 네 번으로 나뉩니다. 첫 시간에는 기획을 하고, 두 번째 시간에 캐릭터·배경·소품 이미지를 만들고, 세 번째 시간에야 영상을 생성합니다. 마지막 시간은 다빈치 리졸브에서 컷을 붙이고 배경음악을 까는 편집입니다.

영상을 만드는 수업인데 실제로 영상을 뽑는 시간은 네 번 중 한 번뿐입니다.

일부러 그렇게 짰습니다. 영상 생성 도구는 몇 달만 지나도 이름도, 메뉴도, 요금도 달라집니다. 새 모델이 나오면 어제의 최고가 오늘은 평범해지기도 합니다. (도구별 기능·요금은 수시로 바뀌니 확인 필요)

하지만 무엇을 찍을지 정하고, 장면을 설명하고, 재료를 준비하고, 결과를 골라 잇는 순서는 도구가 바뀌어도 그대로입니다. 오늘 배운 메뉴 위치는 반년 뒤면 쓸모없어질 수 있지만, 이 순서는 어떤 도구로 옮겨 가도 그대로 쓸 수 있습니다. 저는 그걸 가르치는 게 오래 남는다고 생각합니다.

제가 생각하는 AI 영상 배우는 순서

  1. 기획 — 무엇을, 몇 장면으로 만들지 글로 정한다
  2. 영상의 말 — 앵글·화각·빛·색·카메라 무빙을 단어로 안다
  3. 재료 만들기 — 인물·배경·소품을 먼저 이미지로 고정한다
  4. 생성 — 화면비와 해상도를 정하고 장면마다 영상을 뽑는다
  5. 편집 — 고르고, 버리고, 이어 붙이고, 소리를 입힌다
 (AI로 생성한 이미지)

하나씩 풀어 보겠습니다.😊


첫 번째: AI 영상 기획, 글로 먼저 만드는 영상

AI에게 "멋진 영상 만들어 줘"라고 하면 멋져 보이는 무언가가 나옵니다. 문제는 그게 내가 만들고 싶던 영상이 아니라는 겁니다. 내가 무엇을 원하는지 나도 모르는데, AI가 알 리가 없습니다.

그래서 첫 시간에는 기획안과 장면 목록을 씁니다. 어떤 이야기인지, 누구에게 보여 줄 영상인지, 몇 장면인지, 장면마다 누가 어디서 무엇을 하는지.

예를 들어 제가 수업 예시로 쓰는 「골목 빵집의 아침」이라는 이야기가 있습니다. 이걸 그냥 "빵집 영상"이라고 하면 AI는 아무 빵집이나 보여 줍니다. 하지만 장면을 나눠 적으면 달라집니다. 해 뜨기 전 골목, 불이 켜지는 가게 창문, 반죽을 치대는 손, 오븐에서 나오는 빵, 문을 여는 첫 손님. 이렇게 적는 순간 영상의 뼈대가 생깁니다.

이 단계에서는 클로드나 제미나이 같은 AI가 오히려 좋은 글 상대가 되어 줍니다. 막연한 아이디어를 던지면 이야기의 흐름을 같이 다듬어 주고, 장면을 나누는 것도 도와줍니다. 영상 AI보다 글 AI를 먼저 잘 쓰는 게 AI 영상의 첫걸음인 셈입니다.

기획안 엑셀
기획안 엑셀
장면 엑셀
장면 엑셀
상세 프롬프트 엑셀
상세 프롬프트 엑셀

수강생분들이 이 기획을 이어서 쓸 수 있도록 스토리보드 프로그램과 작성 양식도 따로 만들어 나눠 드리고 있습니다. 엑셀 양식 하나에 기획안, 캐릭터·소품·배경, 장면별 내용을 적으면 프로그램에서 장면 카드로 한 번에 정리되는 방식입니다. 그만큼 기획이 이후 모든 단계의 바탕이라고 보기 때문입니다.

두 번째: 프롬프트보다 먼저 영상의 말을 배우기

프롬프트를 잘 쓰는 법을 묻는 분이 많습니다. 제 답은 조금 엉뚱하게 들릴 수 있습니다. 프롬프트 문장력보다 영상 용어를 먼저 아셔야 합니다.

'샷 크기'에 대해 교육 중
'샷 크기'에 대해 교육 중
'빛의 방향'에 대해 교육 중
'빛의 방향'에 대해 교육 중

로우 앵글인지 하이 앵글인지, 광각인지 망원인지, 역광인지 측광인지, 따뜻한 색인지 차가운 색인지, 카메라가 다가가는지 옆으로 따라가는지. 이 말을 모르면 머릿속에 장면이 있어도 AI에게 설명할 방법이 없습니다. 프롬프트는 결국 장면을 말로 옮긴 것이니까요.

차이를 보시면 바로 느껴지실 겁니다.

용어 없이 쓴 프롬프트

빵집에서 빵을 굽는 제빵사

영상의 말을 넣은 프롬프트

새벽 빵집 주방, 오븐 앞에서 빵을 꺼내는 중년 제빵사. 허리 높이의 아이 레벨 앵글, 표준 화각. 오븐 불빛이 옆에서 들어오는 따뜻한 주황빛 측광, 뒤쪽 창밖은 푸른 새벽빛. 카메라가 천천히 다가가는 돌리 인.

왼쪽은 틀린 프롬프트가 아닙니다. 다만 나머지를 전부 AI에게 맡긴 프롬프트입니다. 오른쪽은 문장을 잘 써서 좋아진 게 아닙니다. 쓰는 사람이 앵글과 빛과 카메라 움직임이라는 말을 알고 있어서 좋아진 겁니다.

그래서 기획 시간에 컬러·조명·화각·앵글 기초를 같이 다룹니다. 말로만 설명하면 와닿지 않기 때문에, 같은 장면을 앵글만 바꾸고, 빛만 바꾸고, 화각만 바꾼 비교 이미지를 제가 직접 만들어 교재에 넣고 있습니다.

카메라 무빙은 정지된 그림으로는 설명이 더 어렵습니다. 그래서 표에서 무빙 이름을 누르면 그 움직임 영상이 바로 나오고, 언제 쓰는지 설명과 프롬프트 예시까지 볼 수 있는 카메라 무빙 사전도 만들어 수강생분들께 나눠 드리고 있습니다.

세 번째: 같은 인물이 계속 나오게 하려면, 재료부터

AI 영상을 처음 만들어 보면 가장 먼저 부딪히는 벽이 있습니다. 장면마다 주인공 얼굴이 바뀝니다. 옷도 바뀌고, 가게 간판도 바뀌고, 집 구조도 바뀝니다. 장면 하나하나는 예쁜데 이어 붙이면 다른 영상 다섯 개를 섞어 놓은 것처럼 보입니다.

학습자들을 위해 만든 'The DnF 스토리보드' 프로그램
학습자들을 위해 만든 'The DnF 스토리보드' 프로그램

그래서 저는 영상을 뽑기 전에 캐릭터, 배경, 소품을 먼저 이미지로 만들어 고정하는 시간을 따로 둡니다. 같은 인물을 정면, 옆모습, 뒷모습처럼 여러 각도에서 만들어 두고, 그 이미지를 바탕으로 장면을 생성하는 방식입니다. 인물이 옷을 갈아입는 이야기라면 옷도 미리 정해 둡니다.

영화로 치면 배우를 캐스팅하고, 의상을 맞추고, 세트를 지어 두는 과정입니다. 이게 되어 있어야 촬영, 그러니까 영상 생성을 할 때 흔들리지 않습니다. 이렇게 보면 영상 생성은 준비된 재료를 움직이게 하는 마지막 단계에 가깝습니다.

학습자들을 위해 만든 'The DnF 스토리보드' 프로그램
학습자들을 위해 만든 'The DnF 스토리보드' 프로그램

네 번째: 영상 생성, 화면비부터 정하고 여러 번 뽑기

힉스필드(Higgsfield) 사이트
힉스필드(Higgsfield) 사이트

재료가 준비되면 드디어 영상을 만듭니다. 기초과정에서는 이미지와 영상을 모두 힉스필드에서 만듭니다. (사용 도구·모델은 수업 시점 기준, 확인 필요)

여기서 의외로 많이 놓치는 게 화면비와 해상도입니다. 유튜브에 올릴 가로 영상인지, 쇼츠나 릴스에 올릴 세로 영상인지를 먼저 정해야 합니다. 이걸 정하지 않고 장면을 다 뽑은 뒤에 바꾸려고 하면, 장면을 처음부터 다시 만들어야 할 수도 있습니다. 그래서 영상 생성 시간에는 포맷과 해상도 개념부터 짚고 들어갑니다.

그리고 한 장면을 한 번만 뽑지 않습니다. 같은 프롬프트로도 결과가 매번 조금씩 다르게 나오기 때문에, 여러 번 뽑아 두고 고르는 게 기본입니다. 이 '고르는' 일이 다음 단계로 이어집니다.

다섯 번째: AI 영상도 결국 편집으로 완성됩니다

생성 버튼을 누르면 영상이 나옵니다. 하지만 한 번에 원하는 컷이 나오는 일은 드뭅니다. 여러 개를 뽑고, 그중 쓸 만한 걸 고르고, 어색한 앞뒤를 잘라 내고, 순서대로 이어 붙여야 하나의 영상이 됩니다.

AI로 생성한 영상에 색보정 작업
AI로 생성한 영상에 색보정 작업

여기에 소리가 더해지면 영상은 또 달라집니다. 같은 장면도 어떤 음악이 깔리느냐에 따라 따뜻하게도, 쓸쓸하게도 보입니다. 그래서 기초과정의 마지막 시간은 항상 다빈치 리졸브에서 컷을 붙이고 배경음악을 입히는 편집입니다.

무엇을 남기고 무엇을 버릴지 정하는 눈이 없으면, 좋은 클립을 아무리 많이 뽑아도 영상이 되지 않습니다. 반대로 편집을 할 줄 알면, 완벽하지 않은 클립으로도 이야기를 만들 수 있습니다. 어색한 마지막 1초를 잘라 내는 것만으로 살아나는 장면도 많습니다.

AI가 해 주는 일, 내가 해야 하는 일

지금까지의 이야기를 한 번에 놓고 보면 이렇습니다.

단계AI가 도와주는 일내가 정해야 하는 일
기획아이디어 넓히기, 문장 다듬기무슨 이야기를, 누구에게, 몇 장면으로
영상의 말프롬프트를 영어로 옮기기어떤 앵글·빛·색·움직임으로 보여 줄지
재료인물·배경 이미지 생성어떤 얼굴·옷·공간으로 고정할지
생성장면을 움직이는 영상으로 만들기화면비, 몇 번 뽑을지, 어떤 걸 쓸지
편집자동 자막, 반복 작업무엇을 남기고 무엇을 버릴지

오른쪽 칸은 어느 도구를 쓰든 내 몫으로 남습니다. 제가 수업에서 시간을 많이 쓰는 곳도 바로 이쪽입니다.

일반인이 처음부터 다 알 필요는 없습니다

이렇게 쓰고 보니 배울 게 많아 보일 수 있습니다. 그런데 제 수업에는 20대부터 60대까지, 대부분 AI 영상을 처음 해 보는 분들이 오십니다. 영상 일을 해 본 적 없는 분이 훨씬 많습니다. 전문가처럼 다 알고 시작할 필요는 없습니다.

제가 권하는 건 하나입니다. 짧은 영상 하나를 기획부터 편집까지 한 바퀴 돌아 보는 것.

다섯 장면이면 충분합니다. 장면 목록을 쓰고, 인물 하나를 만들고, 장면마다 영상을 뽑고, 이어 붙여 음악을 까는 것까지. 처음 만든 영상은 어색할 겁니다. 그래도 한 바퀴를 돌고 나면 다음에 무엇이 부족한지 스스로 보이기 시작합니다. 인물이 자꾸 바뀌었다면 재료를, 장면이 밋밋했다면 영상의 말을, 이야기가 흐릿했다면 기획을 다시 보면 됩니다.

처음부터 한 단계를 완벽하게 익히고 넘어가려고 하면 오히려 지칩니다. 거칠더라도 끝까지 한 번 가 보는 쪽이, 저는 훨씬 빨리 늘어난다고 생각합니다.

여러분이 AI로 만들고 싶은 영상은 몇 장면짜리인가요? 생성 버튼을 누르기 전에, 그 장면들을 글로 먼저 적어 보는 데서 시작해 보셨으면 합니다.