NezhaGate
영상

Wan 3.0

wan3.0-video
모델 타입 StandardPrime

Wan 3.0(통이완샹)은 알리바바의 올라운드 영상 모델입니다. 엔드포인트는 하나이고 입력이 모드를 결정합니다. 소재가 없으면 텍스트-투-비디오, 이미지 한 장이면 첫 프레임, 두 장이면 첫 · 마지막 프레임, 여러 장이면 다중 이미지 참조, 참조 영상을 넣으면 영상 리라이팅이 됩니다. 길이는 2~30초를 1초 단위로, 해상도 세 가지(480P / 720P / 1080P), 화면 비율 다섯 가지를 지원하며 참조 이미지는 최대 10장, 참조 영상 5개, 참조 오디오 5개까지 넣을 수 있고 결과물에 오디오가 포함됩니다. 비동기 방식이라 제출한 뒤 작업 ID를 폴링하면 재호스팅된 안정적인 mp4 링크를 받습니다. 초당 과금하며 실패한 작업은 전액 환불합니다.

텍스트-투-비디오이미지-투-비디오1080P최대 30초

온라인 테스트 · 플레이그라운드

Wan 3.0 바로 여기서 사용해 보기 (로그인 후 사용 가능)。

Input

영상
0 / 5000 바이트
참조 이미지를 여러 장 넣을 때는 프롬프트에서 @Image1 / @Image2로 지칭하세요. 예: "@Image1의 인물이 @Image2의 배경에 서 있다". 따로 지칭하지 않으면 모델이 알아서 판단합니다.
영상 생성은 보통 5~20분 걸리며, 업스트림이 혼잡하면 60분을 넘길 수도 있습니다(저희는 최대 90분까지 기다립니다). 다시 제출하지 마시고 작업 ID를 폴링하며 기다려 주세요 — 다시 제출하면 각각 따로 과금됩니다. 초당 과금하며 실패 시 전액 환불합니다. 프롬프트 길이 제한 5000 바이트(약 1666 자 상당).

Output

video
실행하면 결과가 여기에 표시됩니다.

소개: Wan 3.0

Wan 3.0(통이완샹)은 알리바바의 올인원 영상 모델이며 여기서 가장 다재다능한 영상 라인입니다. 엔드포인트 하나로 텍스트-투-비디오, 첫 프레임, 첫+마지막 프레임, 다중 이미지 참조, 영상 편집을 모두 처리하고, 모드는 모델을 바꾸는 대신 파라미터로 고릅니다. 길이는 2~30초 사이의 정수, 해상도는 480P / 720P / 1080P, 화면 비율은 16:9 / 9:16 / 1:1 / 4:3 / 3:4이며 참조 이미지 10장, 참조 영상 5개, 참조 오디오 5개까지 넣을 수 있고 모든 클립에 오디오 트랙이 담깁니다. 비동기 방식이라 POST /v1/videos/generations가 즉시 HTTP 202와 작업 ID를 돌려주고, GET /v1/videos/jobs/{id}를 status=succeeded가 될 때까지 폴링한 뒤 data[0].url을 읽으면 됩니다. 이 mp4는 저희가 재호스팅한 것이라 업스트림 링크처럼 24시간 만에 만료되지 않습니다.

활용 사례

엔드포인트 하나에 다섯 가지 모드

텍스트-투-비디오, 첫 프레임, 첫+마지막 프레임, 다중 이미지 참조, 영상 편집을 모두 파라미터로 고릅니다.

롱테이크

최대 30초까지 가므로 한 컷으로 끌고 가는 서사 영상을 만들 수 있습니다.

다중 소재 합성

참조 이미지 10장에 참조 영상과 오디오까지 — 인물, 장면, 리듬을 한꺼번에 넣을 수 있습니다.

영상 편집

참조 영상과 한 문장만 주면 화면의 화풍을 바꾸거나 카메라 움직임을 바꿉니다.

어떻게 고를까

15초를 넘기는 클립, 여러 이미지에 영상과 오디오까지 한 번에 넣는 작업, 네이티브 1080P가 필요할 때 고르세요. 급할 때는 Prime을 쓰면 됩니다. 몇 초짜리이고 다중 소재 참조가 필요 없다면 Seedance 계열도 충분합니다.

자주 묻는 질문

다섯 가지 모드는 어떻게 전환하나요?
파라미터만으로 전환합니다. 아무것도 보내지 않으면 텍스트-투-비디오, 이미지 한 장이면 기본이 첫 프레임, 이미지 두 장에 image_role=first_frame이면 첫+마지막 프레임, 두 장을 넘으면 기본이 다중 이미지 참조, video_references를 추가하면 영상 편집이 됩니다. 이미지와 영상을 함께 쓰려면 image_role=reference가 필요합니다.
참조 이미지를 여러 장 넣으면 서로 섞이나요?
섞입니다. 참조 이미지 네 장으로 실측했을 때, 모델은 그중 어느 장에든 보이는 사람을 모두 후보 피사체로 취급했습니다. 클립은 의도한 인물로 시작했다가 나중에 장면 참조에만 등장하던 두 번째 인물로 넘어갔습니다. 장면 참조에는 다른 사람이 없게 하거나, 프롬프트에서 @Image1로 피사체를 지목하세요.
과금은 어떻게 되고 참조 소재에 추가 요금이 붙나요?
초당 과금입니다. 비용 = (출력 길이 + 각 참조 영상의 길이) × 해당 해상도의 초당 단가입니다. 참조 이미지와 참조 오디오는 무료입니다. 제출 시 이 숫자로 예치하고 정산도 같은 숫자라 둘은 항상 일치하며, 실패하거나 시간이 초과되면 전액 환불됩니다. 참조 영상의 초도 과금 대상이므로 그 길이를 명시해야 합니다.
Standard와 Prime은 무엇이 다른가요?
속도와 가격만 다르고 성능은 항목별로 완전히 같습니다. 같은 2초 클립이 Standard에서는 약 2분 45초, Prime에서는 약 37초 걸렸고, Prime의 초당 단가는 약 3분의 1 더 높습니다. 급하지 않다면 Standard를 쓰세요.
렌더링에 얼마나 걸리나요?
Standard 기준 2초 클립이 약 2~3분이고, 참조 이미지 네 장을 넣은 5초 클립은 약 11분이 걸렸습니다. Prime은 눈에 띄게 빠릅니다. 동기적으로 기다리지 말고 10~15초 간격으로 작업 ID를 폴링하세요.

관련 모델

연동할 수 있는 다른 모델도 둘러보세요.

전체 보기 →
GPT-5.6 Sol Chat

GPT-5.6 Sol

gpt-5.6-sol

에이전트 코딩을 위한 프런티어 플래그십

$2.00/1M 입력 · $12.00/1M 출력 ↓75% 보기 →
GPT-5.6 Terra Chat

GPT-5.6 Terra

gpt-5.6-terra

일상용 균형형 에이전트 코딩 모델

$1.20/1M 입력 · $7.00/1M 출력 ↓77% 보기 →
GPT-5.6 Luna Chat

GPT-5.6 Luna

gpt-5.6-luna

빠르고 저렴한 에이전트 코딩 모델

$0.80/1M 입력 · $4.80/1M 출력 ↓68% 보기 →
GPT-5.5 Chat

GPT-5.5

gpt-5.5

플래그십 채팅 · 추론 모델

$0.70/1M 입력 · $4.20/1M 출력 ↓86% 보기 →
GPT-6 Astra Chat

GPT-6 Astra

gpt-6-astra

OpenAI 차세대 플래그십 — 105만 컨텍스트

$2.80/1M 입력 · $14.00/1M 출력 ↓72% 보기 →
GPT Image 2 이미지

GPT Image 2

gpt-image-2

고품질 텍스트-투-이미지 / 이미지-투-이미지 모델

$0.015/장부터 보기 →
GPT Image 2.5 Flare 이미지

GPT Image 2.5 Flare

gpt-image-2.5-flare

차세대 이미지 모델 — 깔끔하고 매끄러운

$0.015/장부터 보기 →
GPT Image 2.5 Sunburst 이미지

GPT Image 2.5 Sunburst

gpt-image-2.5-sunburst

차세대 이미지 모델 — 질감이 더 진한

$0.015/장부터 보기 →
Nano Banana 2 이미지

Nano Banana 2

nano-banana-2

고품질 텍스트-투-이미지 / 이미지-투-이미지 모델

$0.025/장부터 보기 →
Nano Banana Pro 이미지

Nano Banana Pro

nano-banana-pro

플래그십 텍스트-투-이미지 / 이미지-투-이미지 모델

$0.040/장부터 보기 →
Claude Sonnet 4.6 Chat

Claude Sonnet 4.6

claude-sonnet-4-6

균형 잡히고 효율적인 채팅 · 코딩 모델

$1.50/1M 입력 · $7.50/1M 출력 ↓50% 보기 →
Claude Opus 5 Chat

Claude Opus 5

claude-opus-5

Anthropic의 차세대 플래그십

$4.00/1M 입력 · $20.00/1M 출력 보기 →
Claude Fable 5 Chat

Claude Fable 5

claude-fable-5

Anthropic Fable 시리즈 · 서사와 장문 글쓰기

$8.00/1M 입력 · $40.00/1M 출력 보기 →
Gemini 3.1 Pro Chat

Gemini 3.1 Pro

gemini-3.1-pro

Google의 차세대 플래그십 추론 모델

$0.50/1M 입력 · $3.00/1M 출력 ↓75% 보기 →
Gemini 3.8 Flash Chat

Gemini 3.8 Flash

gemini-3.8-flash

최신 Flash · 적응형 사고

$0.60/1M 입력 · $3.60/1M 출력 ↓7% 보기 →
Gemini 3.7 Flash Chat

Gemini 3.7 Flash

gemini-3.7-flash

이전 세대 Flash · 적응형 사고

$0.60/1M 입력 · $3.60/1M 출력 ↓7% 보기 →
Gemini 3.6 Flash Chat

Gemini 3.6 Flash

gemini-3.6-flash

차세대 고속 사고 모델 · 사고 예산 4단계

$0.60/1M 입력 · $3.60/1M 출력 보기 →
Gemini 3.6 Flash High Chat

Gemini 3.6 Flash High

gemini-3.6-flash-high

심층 사고 등급

$0.60/1M 입력 · $3.60/1M 출력 보기 →
Gemini 3.6 Flash Low Chat

Gemini 3.6 Flash Low

gemini-3.6-flash-low

가장 빠르고 가장 저렴한 등급

$0.60/1M 입력 · $3.60/1M 출력 보기 →
Gemini 3.6 Flash Tiered Chat

Gemini 3.6 Flash Tiered

gemini-3.6-flash-tiered

사고량 자동 조절

$0.60/1M 입력 · $3.60/1M 출력 보기 →
Gemini 3 Flash Chat

Gemini 3 Flash

gemini-3-flash-preview

빠르고 지연이 낮은 비용 효율형 채팅 모델

$0.30/1M 입력 · $1.20/1M 출력 ↓57% 보기 →
Gemini 3.5 Flash Chat

Gemini 3.5 Flash

gemini-3.5-flash

차세대 고속 사고 모델

$0.45/1M 입력 · $2.70/1M 출력 ↓70% 보기 →
Gemini 2.5 Flash Chat

Gemini 2.5 Flash

gemini-2.5-flash

빠르고 지연이 낮은 비용 효율형 채팅

$0.30/1M 입력 · $1.20/1M 출력 ↓46% 보기 →
Veo 3.1 영상

Veo 3.1

veo-3.1

텍스트 / 이미지 투 비디오 · 다중 등급 · 다중 해상도

$0.075/건부터 보기 →
Seedance 2.5 영상

Seedance 2.5

seedance-2.5

텍스트 / 이미지 투 비디오 · 최대 30초

$0.158/초 보기 →
Seedance 2.0 영상

Seedance 2.0

seedance-2.0

텍스트 / 이미지 투 비디오 · 5~15초

$0.150/초 보기 →
Seedance 2.0 Fast 영상

Seedance 2.0 Fast

seedance-2.0-fast

낮은 지연 · 최저 비용

$0.100/초 보기 →
Seedance 2.0 Mini 영상

Seedance 2.0 Mini

seedance-2.0-mini

엔트리 등급 · 최저 비용

$0.066/초 보기 →
Wan 3.0 Prime 영상

Wan 3.0 Prime

wan3.0-video-prime

성능은 동일 · 속도는 몇 배

$0.160/초 보기 →
MiniMax H3 영상

MiniMax H3

minimax-h3

1080P · 네이티브 오디오

$0.036/초 보기 →
Grok Imagine Video 1.5 영상

Grok Imagine Video 1.5

grok-imagine-video-1.5

건당 과금 · 최대 15초

$0.300/건부터 보기 →