무료 플래너 · 로그인 불필요 · 크레딧 차감 없음

MiniMax H3긴 영상 플래너

H3는 한 번에 4~15초를 생성합니다. 더 긴 영상은 짧은 구간을 이어 붙여 만듭니다. 이 플래너가 구간을 나누고 각 구간의 프롬프트를 작성하며, 헷갈리기 쉬운 연결 지시까지 정리합니다. 크레딧을 쓰기 전에 총비용도 확인할 수 있습니다.

30초 / 60초 / 90초 / 120초I2VA 연결 프롬프트필요한 크레딧 미리 확인

핵심 답변

MiniMax H3로 60초 영상을 만들 수 있나요?

한 번의 생성으로는 불가능합니다. 호스팅형 H3는 4~15초 범위에서 정수 초만 받습니다. 60초나 120초 영상은 앞 클립의 마지막 프레임에서 다음 클립을 시작해 여러 파일을 이어 붙인 결과입니다. 이를 영상 연장이라고 부르지만, 하나의 긴 영상을 생성하는 것이 아니라 별도의 추론을 연결하는 방식입니다.

  • 한 번에 4~15초 생성하며, 동기화된 오디오도 함께 만듭니다.
  • 60초는 15초 구간 4개, 120초는 15초 구간 8개입니다.
  • 두 번째 구간부터는 직전 클립의 마지막 프레임을 입력 이미지로 사용하는 이미지-투-비디오 작업입니다.

이 페이지는 구간을 계획하고 프롬프트를 작성합니다. 각 구간을 실제로 생성하고 파일을 합치는 일은 직접 순서대로 진행해야 합니다. 전체 영상을 자동으로 생성하고 결합하는 기능은 아직 없습니다.

플래너

H3가 생성할 수 있는 길이로 나누세요

완성 영상 길이와 인물, 장소를 정한 뒤 구간마다 동작 하나를 지정하세요. 아래 프롬프트는 이 도구의 영어 출력 형식으로 바로 복사할 수 있습니다.

영문 프롬프트 예제입니다. 설명은 필요에 맞게 수정할 수 있습니다. 출력 필드명과 구문은 영어로 유지됩니다.

구간마다 동작 하나

이 구간에서 무엇이 달라지는지 적으세요. 줄거리 요약보다 실제 동작이 좋습니다. 할 일이 불분명하면 장면이 변질되거나 같은 움직임을 반복할 수 있습니다.

1
2
3
4

구간별 프롬프트

4개 구간 · 총 60초 · 약 804크레딧

순서대로 생성하세요. 각 클립이 완성되면 마지막 프레임을 추출해 다음 구간의 입력 이미지로 사용합니다.

구간 1 · 0~15초 · 15초

모드: I2VA201 크레딧
For the target video, at 0.00 seconds into the target video, <Picture 1> (from [Shot 1]) is fully referenced.

integrated_multimodal_description: [Shot 1] Live-action, cinematic, a courier in a red rain jacket with a frayed left cuff, mid-twenties, short black hair, in a neon-lit night market street, wet asphalt, stalls still open, matching the position, framing, and lighting established by <Picture 1>. she pushes off the kerb and threads between two stalls, checking the address on her phone.

overall_soundscape: Steady rain on canvas awnings, tyres through standing water, market chatter fading in and out, a tram bell in the distance.

non_diegetic_music: N/A

구간 2 · 15~30초 · 15초

모드: I2VA201 크레딧
For the target video, at 0.00 seconds into the target video, <Picture 1> (from [Shot 1]) is fully referenced.

integrated_multimodal_description: [Shot 1] Live-action, cinematic, a courier in a red rain jacket with a frayed left cuff, mid-twenties, short black hair, in a neon-lit night market street, wet asphalt, stalls still open, continuing without interruption from the position, framing, motion direction, and lighting established by <Picture 1>. she slows at a crossing as a tram passes, rain beading on the jacket. The identity, clothing, colour palette, key props, and lens character stay identical to <Picture 1>; no cut, no restart, no change of shot scale at the opening.

overall_soundscape: Steady rain on canvas awnings, tyres through standing water, market chatter fading in and out, a tram bell in the distance.

non_diegetic_music: N/A

구간 3 · 30~45초 · 15초

모드: I2VA201 크레딧
For the target video, at 0.00 seconds into the target video, <Picture 1> (from [Shot 1]) is fully referenced.

integrated_multimodal_description: [Shot 1] Live-action, cinematic, a courier in a red rain jacket with a frayed left cuff, mid-twenties, short black hair, in a neon-lit night market street, wet asphalt, stalls still open, continuing without interruption from the position, framing, motion direction, and lighting established by <Picture 1>. she lifts the parcel from the crate and scans the shopfront numbers. The identity, clothing, colour palette, key props, and lens character stay identical to <Picture 1>; no cut, no restart, no change of shot scale at the opening.

overall_soundscape: Steady rain on canvas awnings, tyres through standing water, market chatter fading in and out, a tram bell in the distance.

non_diegetic_music: N/A

구간 4 · 45~60초 · 15초

모드: I2VA201 크레딧
For the target video, at 0.00 seconds into the target video, <Picture 1> (from [Shot 1]) is fully referenced.

integrated_multimodal_description: [Shot 1] Live-action, cinematic, a courier in a red rain jacket with a frayed left cuff, mid-twenties, short black hair, in a neon-lit night market street, wet asphalt, stalls still open, continuing without interruption from the position, framing, motion direction, and lighting established by <Picture 1>. she hands the parcel over at a lit doorway and steps back into the rain. The identity, clothing, colour palette, key props, and lens character stay identical to <Picture 1>; no cut, no restart, no change of shot scale at the opening.

overall_soundscape: Steady rain on canvas awnings, tyres through standing water, market chatter fading in and out, a tram bell in the distance.

non_diegetic_music: N/A
생성기에서 첫 구간 만들기

프롬프트가 입력된 이미지-투-비디오 생성기를 엽니다. 실제 생성에는 로그인과 크레딧이 필요합니다.

크레딧을 쓰기 전에

현재 확인된 주의 항목은 없습니다. 생성 후에도 연결 부분을 확인하세요.

작동 원리

‘영상 이어 만들기’의 실제 방식

H3 API에는 extend 매개변수가 없습니다. 연장은 별도 엔드포인트가 아니라 앞 클립의 마지막 프레임 한 장을 다음 생성에 전달해 이어 그리게 하는 작업 방식입니다.

  1. 1

    첫 구간 생성

    텍스트 또는 참조 이미지로 시작합니다. 이 구간이 이후 모든 구간의 인물, 색감, 렌즈 표현의 기준이 됩니다.

  2. 2

    마지막 프레임 추출

    완성된 클립의 맨 끝에서 멈춰 이미지를 저장하거나 편집기로 마지막 프레임을 추출합니다. 이 이미지가 다음 구간의 입력이 됩니다.

  3. 3

    다음 구간을 I2VA로 생성

    마지막 프레임과 플래너의 연결 프롬프트를 사용해 이미지-투-비디오로 생성합니다. 두 번째 이미지가 없으므로 시작·끝 프레임 모드가 아닙니다.

  4. 4

    반복한 뒤 파일 결합

    목표 길이에 도달할 때까지 반복하고 편집기로 클립을 이어 붙입니다. 결합 전에는 각 구간이 별도의 MP4 파일입니다.

연결 뒤에도 이어지는 요소

  • 연결 지점의 구도와 프레이밍. 같은 프레임을 전달하기 때문입니다.
  • 프롬프트에 똑같이 반복한 대상, 의상, 장소, 스타일 지정.
  • 전달하는 프레임의 노출이 적절할 때의 전반적인 색감과 조명.

구간마다 다시 정해지는 요소

  • 움직임. 정지 이미지에는 속도 정보가 없어 모델이 동작을 다시 추정합니다. 빠른 동작은 연결 지점에서 잠깐 멈춘 것처럼 보일 수 있습니다.
  • 오디오. 구간마다 따로 생성되므로 같은 설명을 반복하지 않으면 환경음과 음악이 달라집니다.
  • 화면 밖의 정보. 전달한 프레임에 보이지 않는 대상은 다음 구간에 전달되지 않습니다.

핵심은 입력 이미지 수입니다. 시작과 끝 이미지를 모두 지정한 구간은 FL2VA, 앞 클립의 마지막 프레임 한 장으로 이어 가는 구간은 I2VA를 사용합니다. 두 모드의 지시문은 다릅니다. 이미지 한 장에 FL2VA 문장을 쓰면 원하는 참조가 반영되지 않을 수 있습니다.

기대할 수 있는 결과

여러 구간의 일관성은 얼마나 유지될까요?

각 구간에 전달되는 과거 정보는 한 프레임과 프롬프트뿐입니다. 이 제약을 알면 어떤 요소가 언제부터 흔들리기 쉬운지 이해할 수 있습니다.

구간 수비교적 잘 유지되는 요소흔들리기 시작하는 요소
1~2번째 구간인물, 의상, 색감, 장소.빠른 동작일 경우 첫 연결 지점의 움직임 속도.
3~4번째 구간고정 묘사를 반복했을 때의 인물과 장소.색온도 변화, 작은 소품의 형태.
5~6번째 구간장면의 큰 틀과 명시한 고정 요소.얼굴이 흐려지거나 변형되고 의상의 세부가 달라짐.
7~8번째 구간스타일 지정과 대략적인 배경.첫 구간과 나란히 비교하면 누적된 변화가 뚜렷해지기 쉬움.

작동 원리상 예상되며 커뮤니티에서도 보고되는 문제 유형입니다. 자체 벤치마크로 측정한 발생률은 아닙니다. 수치를 공개할 때는 측정 방법도 함께 밝힙니다.

비용

이 사이트에서 긴 H3 영상을 만드는 비용

H3는 생성한 초 수에 따라 비용이 계산됩니다. 따라서 총길이 비용에 다시 생성한 구간의 비용이 더해집니다. 실제 예산을 좌우하는 것은 구간 계획이 아니라 재생성 횟수입니다.

완성 길이15초 기준 구간 수크레딧두 구간을 다시 만들 경우
30s2402804
60s48041206
90s612061608
120s816082010

이 사이트의 현재 H3 요금 계산을 사용합니다. 생성 실패 시에는 자동 환불되지만, 완성 결과가 마음에 들지 않는 경우는 환불 대상이 아닙니다.

제작 순서

60초 H3 영상 만들기

  1. 1

    구간 계획

    60초와 구간 길이 15초를 선택하면 4개 구간이 나옵니다. 각 구간에 동작을 하나씩 지정해 빈 시간을 만들지 마세요.

  2. 2

    인물 고정 묘사 작성

    대상을 한 번 구체적으로 설명하면 플래너가 네 프롬프트에 같은 문장을 반복합니다. 모습이 달라지는 문제를 줄이기 위한 중요한 준비입니다.

  3. 3

    참조 이미지로 첫 구간 생성

    이미지-투-비디오 생성기를 열고 시작 이미지를 첨부한 뒤 첫 프롬프트를 붙여 넣어 15초로 생성합니다.

  4. 4

    나머지 구간 연결

    완성된 클립의 마지막 프레임을 추출해 다음 구간의 입력으로 사용하고 해당 프롬프트를 붙여 넣습니다. 목표 길이까지 반복합니다.

  5. 5

    클립 결합

    편집기에서 MP4 네 개를 이어 붙입니다. 동작이 다시 시작되는 느낌이 강하면 연결 지점의 몇 프레임을 잘라 다듬으세요.

방식 구분

‘긴 H3 영상’이라고 부르는 세 가지 방식

자주 혼동되는 방식입니다. 이 플래너가 다루는 것은 여러 짧은 구간을 연결하는 방법입니다.

방식의미현재 상태
단일 생성한 번의 추론으로 파일 하나와 오디오를 함께 생성.이용 가능. 최대 15초.
구간별 생성 후 연결앞 클립의 마지막 프레임에서 시작해 여러 번 생성.현재 이용 가능. 이 페이지에서 계획하고 생성과 결합은 직접 진행합니다.
스트리밍·인과적 생성고정된 클립 길이 없이 재생과 함께 영상을 계속 생성.연구 단계. 호스팅형 H3 API와 이 페이지에서는 제공하지 않습니다.

자주 묻는 질문

H3 긴 영상 제작 안내

MiniMax H3 영상의 최대 길이는 얼마인가요?

한 번에 최소 4초, 최대 15초이며 정수 초만 지정할 수 있습니다. 텍스트, 이미지, 참조 기반 생성에 공통으로 적용됩니다. 더 긴 영상은 여러 구간을 이어 붙여 만듭니다.

MiniMax H3로 2분 영상을 만들려면 어떻게 하나요?

15초 구간 8개로 계획하세요. 첫 구간은 참조 이미지로 만들고, 이후에는 앞 클립의 마지막 프레임을 입력 이미지로 사용하면서 동일한 인물 묘사를 반복합니다. 마지막에 8개 파일을 합칩니다. 한두 구간을 다시 만들 여유도 두세요.

H3에 extend나 continue 전용 엔드포인트가 있나요?

없습니다. 호스팅형 API에 extend 매개변수는 없습니다. 앞 클립의 마지막 프레임을 다음 입력 이미지로 전달하는 방식이므로, 연결 프롬프트는 시작·끝 프레임 형식이 아닌 이미지-투-비디오 형식을 사용합니다.

내 영상을 업로드해서 이어 만들 수 있나요?

현재 이 사이트에서는 불가능합니다. 생성기는 영상이 아닌 이미지를 입력받습니다. 이어 만들 영상이 있다면 마지막 프레임을 추출해 그 이미지에서 시작하세요.

연결 부분에서 움직임이 끊기는 이유는 무엇인가요?

정지 이미지에는 속도 정보가 없기 때문입니다. 다음 구간에서 움직임을 다시 추정하므로 빠른 동작은 잠깐 멈춘 것처럼 보일 수 있습니다. 연결 부분의 움직임을 완만하게 하고 편집 시 몇 프레임을 다듬으면 도움이 됩니다.

오디오도 자연스럽게 이어지나요?

자동으로 이어지지는 않습니다. 구간마다 별도로 생성하므로 같은 환경음 지시를 반복해야 합니다. 플래너가 이 문장을 모든 구간에 넣어 줍니다. 음악은 영상을 결합한 후 편집기에서 추가하는 편이 더 안정적입니다.

MiniMax 공식 기능인가요?

아닙니다. 4~15초 제한은 MiniMax의 사양이지만, 구간을 연결하는 것은 커뮤니티 작업 방식이며 이 플래너는 당사 구현입니다. 이 사이트는 MiniMax와 제휴 관계가 없습니다.

여기서 계획하고, 생성기로 완성하세요

이 사이트의 H3 이미지-투-비디오는 시작 이미지와 선택 사항인 끝 이미지를 받습니다. 위에서 구간을 계획한 뒤 하나씩 생성하세요.

I2VA 지시문, FL2VA 이미지 정렬 문장, 소수점 둘째 자리까지의 시간, 세 가지 출력 필드는 H3 공개 가중치에 포함된 MiniMaxAI의 Video Prompt Writing Guide를 바탕으로 하며 2026년 8월 기준으로 확인했습니다. 4~15초 제한은 호스팅형 API 사양입니다. 이 사이트는 MiniMax와 제휴 관계가 없습니다.