AI 모션 그래픽, 프롬프트를 ‘촬영 지시서’처럼 쓰면 달라집니다 — 레퍼런스로 원하는 느낌 만드는 법 | DAKER 커뮤니티
AI 영상 생성 도구를 써 보신 분이라면 한 번쯤 느끼셨을 겁니다. 사람이 걷는 장면이나 바다 풍경처럼 실사 영상은 제법 그럴듯하게 나오는데, 글자가 튀어나오고 도형이 착착 맞물리는 2D 모션 그래픽(그림과 글자를 움직여 만드는 영상)은 이상하게 잘 안 나옵니다. 디자인하는AI 채널의 이번 영상은 바로 그 부분이 요즘 많이 달라졌다며, 모션 그래픽 지식이 없어도 원하는 느낌으로 만들 수 있는 방법을 처음부터 보여 줍니다.

먼저 알려 드릴 점이 있습니다. 영상 제목에 “feat. Newtake”가 붙어 있고, 실습 대부분을 뉴테이크(Newtake)라는 AI 영상 제작 플랫폼에서 진행합니다. 설명란에도 추적 코드가 붙은 뉴테이크 링크가 있습니다. 영상 안에서 협찬 여부를 따로 밝히지는 않지만, 특정 서비스를 소개하는 성격이 있는 영상으로 보시면 됩니다. 그래서 이 글에는 그 링크를 넣지 않았습니다. 제작자도 “여러 영상 모델을 쓸 수 있는 다른 서비스를 써도 된다”고 말하고, 제가 보기에도 영상의 진짜 알맹이는 특정 도구보다 프롬프트를 설계하는 방식에 있었습니다. 그 부분 위주로 정리하겠습니다.
왜 하필 ‘움직이는 글자’부터 시작할까
영상은 세 가지 유형을 차례로 만듭니다. 키네틱 타이포그래피, 캐릭터 애니메이션, 제품 홍보 영상입니다. 키네틱 타이포그래피는 글자 자체를 커졌다 작아졌다, 돌거나 모양이 바뀌게 움직여서 메시지를 강조하는 방식입니다. 광고 첫머리에 문구가 리듬감 있게 튀어나오는 장면을 떠올리시면 됩니다.
이걸 제일 먼저 해 보는 이유가 설득력 있었습니다. 캐릭터나 제품은 장면이 바뀌어도 생김새가 똑같이 유지돼야 해서 난도가 높습니다. 반면 글자 영상은 그런 걱정이 없으니 AI가 움직임을 어떻게 만들어 내는지 순수하게 시험해 보기 좋다는 겁니다. 제작자는 자기 유튜브 채널을 홍보하는 10초짜리 영상을 예제로 삼습니다.
핵심은 프롬프트를 ‘촬영 지시서’처럼 쓰는 것
영상을 보면서 가장 기억에 남은 말이 이것이었습니다. 프롬프트(AI에게 주는 지시문)를 촬영 지시서처럼 쓰라는 겁니다. 어떤 문구를 보여 줄지만 적는 게 아니라, 영상을 몇 장면으로 나눌지, 글자를 어떻게 움직일지, 언제 다음 장면으로 넘길지까지 최대한 구체적으로 정해 주라는 이야기입니다.
문제는 모션 그래픽을 배워 본 적 없는 사람은 이걸 어떤 순서로, 어떤 용어로 써야 할지 모른다는 점입니다. 제작자는 이 빈칸을 AI에게 채우게 하는 방법 두 가지를 제안합니다.
방법 1: 가이드를 주고 챗봇에게 지시서를 받기
첫 번째는 제작자가 만든 프롬프트 작성 가이드를 챗GPT, 제미나이, 클로드 같은 챗봇에 먼저 넣는 방법입니다. 그다음 “이 가이드대로, 내 채널을 조사해서 키네틱 타이포그래피 영상 프롬프트를 써 줘”라고 부탁하면, 챗봇이 채널을 조사한 뒤 꽤 긴 지시서를 만들어 줍니다. 가이드 파일은 영상 설명란에 공유되어 있습니다.
영상에서 결과물을 한 줄씩 짚어 주는데, 정말 촬영 현장 콘티처럼 생겼습니다. 전체 길이는 10초로 정해져 있고, 색상과 글꼴, 화면을 나누는 격자(그리드), 그래픽 요소까지 디자인 방향이 먼저 정리돼 있습니다. 그 아래가 핵심인 장면 구성인데요, 10초를 다섯 개 샷으로 쪼개서 첫 샷은 1.6초까지 질문을 던져 시선을 잡고, 3.7초부터는 핵심 메시지를 글자와 연결선으로 보여 주고, 8.3초부터는 채널 이름을 완성한 뒤 화면을 멈춰 이름을 각인시키는 식입니다. 카메라 움직임은 과하게 튀거나 흔들리지 않게 제한하고, 클릭음과 전환 효과음, 120BPM(1분에 120박자) 배경 음악까지 적혀 있습니다. 마지막에는 엉뚱한 요소가 끼어들지 않도록 막는 규칙, 즉 가드레일도 들어갑니다.
여기서 실용적인 팁이 하나 나옵니다. 영상 속 문구를 바꾸고 싶으면 각 샷에 들어간 문구와 함께 ‘반드시 들어갈 문구’ 목록도 같이 고쳐야 하고, 띄어쓰기와 문장 부호까지 맞춰 줘야 한다는 점입니다. AI 영상에서 글자가 자꾸 틀리게 나와 고생해 본 분이라면 공감하실 대목입니다.
이렇게 만든 지시서를 뉴테이크 캔버스에 붙이고, 비디오 생성 노드(작업 단계를 상자 모양으로 연결하는 방식의 한 칸)를 이어 붙인 뒤 모델을 고릅니다. 제작자가 고른 건 미니맥스(MiniMax)의 영상 모델입니다. 모션 그래픽 전용은 아니지만 글자와 그래픽 표현, 복잡한 지시를 따르는 능력, 레퍼런스를 참고한 움직임 제어에 강하고 비용 대비 품질도 괜찮다는 게 제작자의 설명입니다. 길이는 지시서에 맞춰 10초, 화면 비율은 일반 유튜브면 16:9, 쇼츠나 릴스면 9:16으로 맞추면 되고, 생성에는 대략 5~10분이 걸린다고 합니다.
재미있었던 건 그다음입니다. 같은 지시서에서 스타일 부분만 네오브루탈리즘(굵은 테두리와 강한 원색을 쓰는 거친 디자인 스타일) 에디토리얼 컨셉으로 바꾸자, 장면 구성은 그대로인데 분위기가 완전히 다른 영상이 나왔습니다. 지시서를 한 번 잘 만들어 두면 스타일만 갈아 끼우며 여러 버전을 뽑을 수 있다는 뜻이라, 이 부분이 이 방식의 진짜 장점이라고 느꼈습니다.
방법 2: 마음에 드는 영상을 보여 주고 따라 하게 하기
두 번째 방법은 반대 방향입니다. 이미 마음에 드는 모션 그래픽 영상이 있다면, 그 영상을 AI에게 분석시켜서 프롬프트로 바꾸는 겁니다. 제작자는 핀터레스트에서 ‘Hello’라는 글자가 손 모양으로 변해 흔들리는 영상을 골랐습니다.
이번에도 챗GPT를 쓰는데, 컴퓨터 유즈(AI가 직접 브라우저를 열고 화면을 보며 조작하는 기능)로 레퍼런스 영상 링크에 들어가 분석하라고 지시하고, 앞의 가이드도 함께 넣습니다. 그러면 챗GPT가 실제로 링크를 열고 스크린샷을 찍어 가며 색감, 화면 구성, 글자 움직임, 장면 전환 방식을 하나씩 살펴본 뒤 가이드 형식에 맞춘 지시서를 내놓습니다. 모션 그래픽 용어를 몰라도 레퍼런스에서 필요한 연출 용어를 뽑아낼 수 있다는 점이 핵심입니다. 이 지시서로 13초짜리 영상을 만들었더니 원본과 꽤 비슷한 결과가 나왔습니다.
뉴테이크 안에는 이런 분석을 도와주는 ‘스마트 분석’ 기능도 있습니다. 같은 글자가 여러 개로 복제돼 시간차를 두고 따라 움직이는 복잡한 영상처럼 말로 설명하기 어려운 경우에 쓰는데요, 영상을 올리고 샷·모션·음악 중 분석할 항목을 고르면 장면별로 쪼개서 정리해 줍니다. 제작자는 음악은 빼고 샷과 모션만 분석한 뒤, 그 결과를 앞에서 만든 키네틱 타이포그래피 지시서와 함께 비디오 노드에 연결해 반복되는 글자 효과가 살아 있는 영상을 만들어 냅니다.
캐릭터와 제품은 ‘레퍼런스 이미지를 두 번’
캐릭터가 나오는 영상부터는 난도가 올라갑니다. 장면마다 캐릭터 얼굴이나 비율이 달라지면 바로 티가 나니까요. 제작자의 해법은 레퍼런스 이미지(참고용 그림)를 프롬프트를 만드는 단계부터 함께 넣는 것입니다. 이번에는 뉴테이크 안에서 캐릭터 이미지와 가이드를 텍스트 생성 노드에 연결하고, 비용이 적게 드는 제미나이 모델을 골라 “플랫한 캐릭터가 나오는 쇼핑몰 할인 오픈 영상 프롬프트를 써 줘”라고 짧게 요청합니다. 그렇게 나온 지시서로 영상을 만들면 캐릭터의 과장된 팔다리와 선명한 색감이 꽤 잘 살아납니다.
여기서 중요한 한 끗이 있습니다. 캐릭터가 레퍼런스와 거의 똑같이 유지돼야 한다면, 프롬프트를 만들 때뿐 아니라 영상을 생성하는 단계에서도 레퍼런스 이미지를 한 번 더 넣어 줘야 한다는 점입니다. 실제로 그렇게 하자 원본과 거의 같은 캐릭터가 영상에 나왔습니다. 제품 영상도 원리는 같습니다. 제품은 모양, 색, 로고, 글자가 장면마다 바뀌면 안 되니까, 지시서를 만든 뒤 제품 사진을 레퍼런스로 함께 넣어 생성하면 외형은 지키면서 움직임만 다양하게 줄 수 있습니다.
만들기 전에 25칸 스토리보드로 흐름 보기
마지막으로 소개하는 건 스토리보드입니다. 영상을 바로 만들기 전에 어떤 순서로 장면이 흘러갈지 미리 보고 싶을 때, 제품 사진 한 장과 지시서를 연결해 이미지 모델로 ‘25칸 연속 스토리보드’를 만들면 한 장의 이미지 안에 연속된 샷 25개가 그려집니다. 제품이 어떤 구도로 등장하고 장면이 어떻게 이어지는지 영상 생성 비용을 쓰기 전에 확인할 수 있는 셈입니다. 제품 사진 한 장만으로 이 스토리보드를 만들고 그걸 바탕으로 영상을 생성하면 이야기가 있는 홍보 영상이 나온다는 것도 보여 줍니다.
그리고 제작자가 솔직하게 덧붙인 말이 있습니다. 이런 스토리보드는 GPT 이미지 모델로도 충분히 만들 수 있으니, 뉴테이크를 쓰지 않는 분이라면 굳이 크레딧을 더 살 필요는 없다는 겁니다. 서비스를 소개하는 영상에서 이런 말을 해 주는 건 반가웠습니다.
따라 해 보기
- 만들고 싶은 10초짜리 영상의 문구를 정하고, 챗봇에게 “장면 5개로 나눠 각 장면의 시작 시간, 글자 움직임, 전환 방식, 색과 글꼴, 효과음까지 적은 영상 생성 프롬프트를 써 줘”라고 부탁해 보십시오.
- 결과가 마음에 들면 스타일 부분만 바꿔서 한 번 더 생성해 보십시오. 구성은 같고 분위기만 다른 버전을 비교할 수 있습니다.
- 캐릭터나 제품이 나온다면 참고 이미지를 프롬프트 만들 때와 영상 만들 때 두 번 넣으십시오.
보고 나서 든 생각
이 영상을 보고 나니, AI 영상이 원하는 대로 안 나오는 이유가 모델 탓만은 아니라는 생각이 들었습니다. 우리가 AI에게 “멋진 모션 그래픽 만들어 줘”라고만 말하고, 정작 몇 초에 무엇이 어떻게 움직여야 하는지는 알려 주지 않았던 거죠. 그 지시서를 사람이 처음부터 쓰기 어렵다면 챗봇이나 레퍼런스 분석으로 초안을 받으면 된다는 게 이 영상의 가장 쓸모 있는 교훈이었습니다. 도구는 뉴테이크든 다른 서비스든 상관없습니다. 좋은 지시서 한 장이 있으면 어디서든 다시 쓸 수 있으니까요.
출처
- 디자인하는AI, 이런 2D 모션그래픽, 이제 AI로 직접 만드세요 | AI 모션그래픽, 원하는 느낌으로 만드는 방법 (feat. Newtake) (YouTube, 2026-09-25, 15:10): https://www.youtube.com/watch?v=9uQVYIaYIeg
- 참고: 영상은 뉴테이크 플랫폼을 중심으로 진행되는 서비스 소개 성격의 콘텐츠이며, 이 글은 설명란의 추적 코드가 붙은 링크를 포함하지 않습니다.