Midjourney에서 AI 영상으로: 외형 변화 없이 캐릭터 움직이기

읽는 시간 약 9분

Midjourney 캐릭터의 모습을 잃지 않고 움직이려면 깔끔한 정지 이미지 한 장으로 정체성을 고정하고, 영상 프롬프트에는 캐릭터 전체를 다시 설명하지 말고 동작을 적으세요. 제 원칙은 간단합니다. 정지 이미지는 정체성을, 프롬프트는 움직임을 담당합니다.

정지 이미지에서 얼굴, 손, 의상 디테일이 불분명하다면 저는 영상화 전에 이미지를 수정합니다. 긴 움직임 프롬프트로 빠진 시각 정보를 살리기는 어렵고, 모델이 새롭게 해석할 여지만 늘어날 수 있습니다.

움직이기 시작하면 Midjourney 캐릭터가 달라지는 이유

Midjourney는 한 가지를 특히 잘합니다. 실제로 원하는 얼굴과 색상 팔레트, 렌더링 스타일을 갖춘, 스타일이 고정된 정지 이미지를 만드는 것입니다. 문제는 다음 도구로 넘기는 순간 시작됩니다.

대부분의 크리에이터는 애니메이션을 만들 때 “애니메이션 소녀, 은색 머리, 빨간 재킷, 걷기”처럼 캐릭터를 다시 설명해서 원래 모습을 잃습니다. 이제 영상 모델에는 이미지와 문장이라는 두 가지 기준이 있습니다. 모델이 둘을 섞으면서 얼굴이 달라집니다.

이미지에서 영상으로 넘어갈 때 새 글 설명이 이미 이미지에 있는 디테일과 충돌하면서 변화가 시작되기도 합니다. 참조 이미지는 정체성과 스타일의 기준으로 삼고 영상 프롬프트는 움직임과 카메라 지시에 집중하세요.

Midjourney에서 직접 이미지를 움직일 수 있나요?

Midjourney 영상은 5초로 시작합니다. 4초씩 네 번 연장해 최대 21초로 만들 수 있습니다. Low Motion, High Motion, 선택적인 동작 프롬프트, 반복 재생, 다른 끝 프레임을 지원합니다. 기본 출력은 480p이며 Standard, Pro, Mega 요금제는 Fast Mode에서 720p를 생성할 수 있습니다.

흩날리는 머리카락, 느린 푸시인, 천의 움직임, 공기감처럼 분위기를 만드는 움직임은 정말 잘합니다.

하지만 캐릭터 연기까지는 하지 못합니다. 립싱크도 기본 오디오도 없으므로 캐릭터가 말하거나 노래할 수 없습니다. 참고 연기를 넣어 캐릭터가 그 동작을 따라 하게 할 수도 없습니다. 또한 움직이는 대상에 대한 제어도 제한적입니다. 가만히 있어야 할 입과 얼굴을 움직인다는 불만이 크리에이터들 사이에서 흔합니다.

그러니 솔직히 말하면, 정지 이미지에 숨결만 더하고 싶다면 Midjourney의 Animate로 충분한 경우가 많습니다. 캐릭터가 연기하게 하려면 이미지를 기준으로 삼는 영상 도구 구성이 필요합니다. 아래에서 그 워크플로를 다룹니다.

움직이기 전에 모습 확정하기

처음 잘 나온 이미지가 아니라 디테일이 가장 정돈된 이미지를 움직이세요.

움직임에 적합한 참조 이미지는 얼굴이 명확하고 의상이 분명하며 조명이 고르고 팔다리가 잘리지 않은 경우가 많습니다. 동작 모델은 보이는 정보에서 추론하므로 정지 이미지의 모호한 부분이 영상에서 새롭게 만들어집니다.

수정 비용이 아직 낮을 때 문제를 고치세요. DomoAI의 멀티 모델 이미지 생성·편집 도구에서는 영상 크레딧을 하나라도 쓰기 전에 Midjourney 정지 이미지를 정리할 수 있습니다. 손을 고치고, 옷의 글자를 수정하고, 의상 세부 요소를 조정하거나 복잡한 배경을 단순하게 만들 수 있습니다. 여기에는 세 가지 모델 선택지가 있습니다. GPT Image 2는 정밀한 제어와 깔끔한 글자 표현에, Nano Banana 2는 빠른 일상 편집에, Nano Banana Pro는 캐릭터 일관성을 유지하는 작업에 적합하며, 한 세션에서 참조 이미지를 최대 9장 받고 4K로 출력합니다.

두 번째 포즈나 각도가 필요하다면 Nano Banana Pro에 여러 참조를 제공해 시각적 맥락을 늘릴 수 있습니다. 움직이기 전에 채택한 캐릭터와 결과를 비교하세요.

쓸 이미지는 모두 Assets에 저장하세요. 샷마다 재사용할 수 있고 다시 업로드할 필요가 없습니다.

샷에 맞는 애니메이션 경로 선택하기

하나의 만능 “Midjourney를 영상으로” 버튼은 없습니다. 작업이 하나가 아니기 때문입니다. 세 가지 경로로 거의 모든 일을 처리할 수 있으며, 경로를 잘못 고르는 것은 외형이 달라지는 두 번째로 큰 원인입니다.

경로 1: 좋은 이미지 한 장을 움직이는 샷으로 만들기

Image to Video를 사용하세요. Midjourney 캐릭터 공개, 분위기 샷, 카메라 전진, 메인 프레임을 움직이는 기본 경로입니다.

DomoAI는 이미지 투 비디오 모델로 Seedance 2.0을 제공하며, 4~15초 출력, 480P/720P/1080P 설정, 영화 같은 움직임, 기본 오디오, 멀티샷을 지원합니다. DomoAI 2.4.1 Advanced와 Fast도 사용할 수 있으며, 5초 또는 10초 클립에서 사실적인 움직임과 시각적 일관성을 제공합니다.

실용적인 조언은 이렇습니다. 움직임이 맞을 때까지 Fast 모델과 낮은 해상도로 초안을 만든 다음, 가장 좋은 결과를 1080P로 다시 생성하세요. 캐릭터 샷은 여러 번 시도하는 경우가 많고, 버릴 결과에 정가를 쓸 이유는 없습니다.

경로 2: 샷의 시작과 끝이 모두 중요한 경우

Frames to Video를 사용하세요. 눈 감기에서 뜨기, 평상복에서 무대 의상, 변경 전후 같은 전환에 적합합니다.

두 가지 모드가 있고 차이는 분명합니다. Seedance 2.0 / Seedance 2.0 Fast에서는 시작 프레임과 끝 프레임만 제공하면 모델이 중간을 채웁니다. DomoAI 2.4.1에서는 구간별 동작 프롬프트와 함께 키프레임 2~8장을 제공해 1~56초를 생성할 수 있습니다. Midjourney에서 장면의 스토리보드를 만들었고 영상이 각 프레임을 정확히 거치게 하고 싶을 때 필요한 방식입니다.

Midjourney도 시작 프레임에서 다른 끝 프레임으로 애니메이션을 만들 수 있습니다. Midjourney 안에서 최대 21초의 전환을 만들려면 이 기능을 쓰세요. Seedance의 시작/끝 제어나 DomoAI 2.4.1의 키프레임 2~8장, 구간별 프롬프트, 1~56초 워크플로가 필요하면 DomoAI Frames to Video를 쓰세요.

경로 3: 참조 동작을 캐릭터가 연기하게 하기

Character to Video를 사용하세요. 이것은 Midjourney가 할 수 없는 작업이며, 대부분의 캐릭터 크리에이터가 결국 두 번째 도구를 사용하는 이유입니다.

참조 영상과 Midjourney 캐릭터 이미지를 넣으세요. 원래 움직임을 정확하게 보존하면서 캐릭터를 교체합니다. 춤 영상, 걷기 루프, 몸짓을 이제 여러분의 캐릭터가 수행합니다. Subject Only 모드는 캐릭터를 바꾸면서 장면의 나머지 부분을 원본에 더 가깝게 유지합니다.

Seedance 2.0 모드는 4~15초이며, DomoAI 2.4.1은 한 번에 최대 30초를 생성합니다. 캐릭터 이미지는 최대 10MB의 JPEG, PNG, JPG를 사용할 수 있고, 참조 영상은 MP4, MOV, AVI를 사용할 수 있습니다.

이것이 한 단계로 끝나는 애니메이션과 VTuber 워크플로입니다. Midjourney로 만든 오리지널 캐릭터 정지 이미지와 춤 참조 영상만 있으면, 직접 한 프레임도 애니메이션을 만들지 않고 캐릭터가 춤추게 됩니다.

움직임 전에 정체성 확인 카드 만들기

저는 원본 이미지 옆에 작은 정체성 카드를 저장합니다. 거대한 프롬프트가 아니라 모든 클립의 시작, 중간, 끝에서 확인할 짧은 디테일 목록입니다.

고정할 요소기록할 내용클립을 제외할 조건
얼굴눈 색상, 얼굴 형태, 헤어라인, 대표 특징두 가지 이상의 특징이 바뀜
의상재킷 형태, 테두리 색상, 액세서리핵심 디테일이 사라지거나 좌우가 바뀜
실루엣머리 길이, 어깨 너비, 치마나 코트 윤곽핵심 동작 중 몸의 윤곽이 달라짐
크롭, 렌즈 느낌, 카메라 높이, 빛 방향구도가 이전 샷과의 연속성을 깨뜨림
움직임 한도피사체 동작 하나 + 카메라 움직임 하나 + 분위기 요소 하나불필요한 동작이 생겨 정체성을 가림

원본 이미지 검사에서 이미 두 항목이 실패하면 저는 멀티 모델 이미지 생성·편집 도구로 돌아갑니다. 애니메이션 원본에서는 Niji 7 애니메이션 가이드가 이미지 디자인 선택과 움직임 선택을 구분하는 데 도움이 됩니다. 더 긴 장면에는 캐릭터 일관성 유지 과정을 사용하고 AI 스토리보드 가이드로 장면을 계획합니다.

첫 샷에 복사해서 쓸 수 있는 프롬프트

프롬프트는 움직임과 카메라를 설명합니다. 캐릭터를 설명하지 않습니다. 이미 이미지가 그 일을 했습니다.

피사체는 위치를 유지하며 천천히 숨을 쉬고 머리카락은 부드럽게 움직인다. 카메라는 천천히 다가가고 피사계 심도는 얕다. 부드러운 윤곽광과 공기 중 먼지 입자. 얼굴, 의상, 머리 모양은 바꾸지 않는다.

마지막 문장에 주목하세요. 무엇이 바뀌면 안 되는지 명시하는 것은 화려하지 않지만 효과가 있습니다. 더 세밀하게 제어하려면 시간 구간별로 카메라 지시를 넣으세요. 예를 들면 CAM 1 (0-3s): slow push in입니다. 또는 AI Optimize를 눌러 짧은 프롬프트를 모델이 실제로 활용할 수 있는 내용으로 확장하세요.

모습이 계속 무너질 때 수정하기

중간에 얼굴이 바뀝니다. 정지 이미지의 정보량에 비해 클립이 너무 깁니다. 줄이세요. 깔끔한 5초 클립 두 개를 이어 붙이는 편이 외형이 달라지는 15초 테이크 하나보다 낫고, 이것이 가장 흔하게 효과를 보는 해결책입니다.

의상에 없던 세부 요소가 생깁니다. 정지 이미지에서 그 부분이 모호했던 것입니다. 이미지 편집으로 돌아가 세부 요소를 명확하게 한 뒤 다시 움직이세요. 모호한 원본 이미지를 프롬프트로 우회하려 하지 마세요.

움직이면 안 되는 캐릭터가 움직인다면 “얼굴, 의상, 머리 모양 변경 없음”을 명시하고 움직임이 적은 구도로 바꾸세요.

스타일이 밋밋해지면 Midjourney의 렌더링도 캐릭터의 일부임을 기억하세요. 움직임을 줄여 보세요. 큰 움직임은 새롭게 채울 부분을 늘리고 그 과정에서 스타일이 달라질 수 있습니다.

매번 모든 것이 달라집니다. 문제는 모델이 아니라 참조 정지 이미지입니다. 잘린 구도, 극단적인 각도, 짙은 그림자는 모두 모델에 필요한 정보를 빼앗습니다. 더 깔끔하고 평평한 각도에 전체가 더 잘 보이는 참조 이미지를 다시 생성해서 시도하세요.

캐릭터가 말하거나 노래하게 하기

Midjourney 영상에는 립싱크가 없으므로 이 단계에서는 항상 플랫폼을 옮겨야 합니다.

Talking Avatar는 Midjourney 캐릭터 이미지와 오디오를 받아 말하거나 노래하는 캐릭터를 만듭니다. 오디오는 DomoAI의 텍스트 음성 변환 결과나 업로드한 MP3/WAV를 사용할 수 있습니다. 기본 길이는 5초/10초/20초이며, Pro 요금제의 빠른 모드에서는 30초와 60초를 지원합니다. 표정은 대본과 별도로 지시할 수 있으므로 “미소 짓기”나 “끄덕이기”를 대사에 몰래 넣을 필요가 없습니다.

AI 가수는 긴 보컬을 짧은 구간으로 나누세요. 잘못된 15초 테이크를 검토하고 교체하는 편이 곡 전체를 다시 생성하는 것보다 훨씬 저렴합니다.

한 가지 한계를 솔직히 밝히면, 배경 음악과 곡 전체의 믹싱은 여기서 하지 않습니다. 클립을 내보낸 다음 CapCut, Premiere Pro, DaVinci Resolve에서 아래에 음원 트랙을 놓으세요.

클립 마무리하기

생성 해상도는 최대 1080P입니다. 납품할 때는 최종 편집본을 Video Upscaler에 넣어 최대 4K로 만드세요.

순서가 중요합니다. 모든 초안이 아니라 남길 테이크를 업스케일하세요. 반복 작업이 많다면 Relax Mode는 Standard 이상 요금제에서 대상 결과물을 크레딧 소모 없이 생성합니다. 더 느리지만 캐릭터 작업은 시도 횟수가 중요한 일이며, 여기서 그 비용이 감당할 만해집니다. 자세한 내용은 요금 페이지에서 확인할 수 있습니다.

자주 묻는 질문

Midjourney 이미지를 AI 영상 도구에서 상업적으로 쓸 수 있나요?

Midjourney는 약관과 예외에 따라 구독자가 일반적으로 자신이 만든 이미지와 영상을 소유한다고 설명합니다. 연간 총매출이 100만 달러를 넘는 기업은 상업적 사용에 Pro 또는 Mega 요금제가 필요합니다. DomoAI는 유료 요금제 결과물에 상업적 권리를 부여합니다. 고객용으로 공개하기 전에 두 서비스의 최신 약관을 확인하세요.

샷마다 캐릭터가 다르게 보이는 이유는 무엇인가요?

이미지가 맡아야 할 캐릭터 설명을 프롬프트로 하고 있기 때문입니다. 고정된 참조 정지 이미지 한 장에서 애니메이션을 만들고 프롬프트는 움직임으로만 제한하세요.

Midjourney 자체 영상 모델이면 충분한가요?

정지 이미지 한 장에 분위기 있는 움직임을 더하는 데는 충분한 경우가 많습니다. 립싱크, 참조 연기의 동작 전이, 연장 한도를 넘는 클립에는 전용 영상 도구 구성이 필요합니다.

Midjourney 이미지 한 장으로 가장 길게 만들 수 있는 클립은 몇 초인가요?

Midjourney는 5초로 시작해 4초씩 네 번 연장할 수 있으며 최대 21초입니다. DomoAI에서 Seedance 2.0을 사용하는 정지 이미지 한 장의 Image to Video는 4~15초입니다. 더 긴 Frames to Video와 Character to Video 워크플로는 추가 입력을 사용해 다른 작업을 해결합니다.

도구마다 이미지를 다시 업로드해야 하나요?

아니요. 정지 이미지를 Assets에 한 번 저장한 다음 History 패널에서 다음에 쓸 도구로 바로 끌어다 놓으세요.

이미지 한 장으로 시작하기

모습을 공들여 지켜 온 최고의 Midjourney 캐릭터를 골라 한 번 깔끔하게 편집한 뒤 5초 애니메이션 하나를 만드세요. 우선 전체 뮤직비디오가 아니라 샷 하나부터 시작합니다.

얼굴이 유지되면 워크플로도 유지됩니다. 위의 나머지 내용은 제작 규모를 키우는 일일 뿐입니다.

DomoAI로 Midjourney 캐릭터 움직이기 →

최신 글