알리바바가 완 3.0 영상 모델을 전체 공개로 풉니다 | DAKER 커뮤니티
알리바바의 QwenCloud 모델 변경 로그에 8월 24일 항목 두 개가 올라왔습니다. 초대 전용으로만 돌아가던 영상 생성 모델 Wan 3.0이 전체 공개로 풀렸고, 같은 날 속도를 올린 변형 하나가 함께 등재되었습니다.

나온 것
1. Wan 3.0이 정식 제공으로 올라갔습니다. QwenCloud 모델 변경 로그의 2026년 8월 24일 항목에 wan3.0-video가 일반 제공 상태로 기재되었습니다. 로그에는 8월 6일에 초대 전용 테스트로 시작했고 이제 공개적으로 쓸 수 있다는 설명이 붙어 있습니다. 초대 전용에서 전체 공개까지 걸린 기간이 3주가 되지 않습니다.
2. 세 가지 생성 방식을 한 모델이 처리합니다. 로그는 Wan 3.0을 올인원 영상 생성 모델로 설명합니다. 텍스트로 영상을 만드는 방식, 이미지로 영상을 만드는 방식, 참조물로 영상을 만드는 방식을 하나의 통합 모델에서 모두 지원한다고 적혀 있습니다. 이미지 기반 생성은 첫 프레임만 주는 경우와 첫 프레임과 마지막 프레임을 함께 주는 경우가 따로 명시되어 있습니다. 시작과 끝을 정해 두고 사이를 채우게 만드는 작업이 별도 모델 없이 가능하다는 뜻입니다.
3. 기능 네 가지가 이름으로 적혀 있습니다. 오디오 생성, 소리를 켜고 끄는 전환, 길이를 알아서 정하는 기능, 화면비를 상황에 맞추는 기능입니다. 영상만 만들고 소리를 따로 붙이는 흐름이 아니라 소리까지 한 번에 나오는 구조이고, 필요할 때 소리를 끌 수 있게 해 두었습니다. 길이와 화면비를 모델이 정한다는 점은 짧은 광고 소재나 세로 영상을 여러 개 뽑아야 하는 작업에서 손이 덜 가는 방향입니다.
4. 고속 변형이 같은 날 함께 올라왔습니다. wan3.0-video-prime은 Wan 3.0의 고속 변형으로 기재되었습니다. 로그는 wan3.0-video와 같은 올인원 기능을 제공하면서 생성 속도가 더 빠르다고만 적었습니다. 두 항목이 같은 날짜에 나란히 등재되었으니, 품질을 보는 작업과 회전 수를 보는 작업을 나누어 쓰라는 구성으로 읽힙니다.
5. 이 변경 로그의 8월은 유난히 빽빽합니다. 같은 페이지에서 8월 항목만 훑어도 흐름이 보입니다. 8월 3일에 Qwen3.8 Max가 등재되었고, 로그는 2.4조 파라미터 규모의 MoE 구조에 네이티브 비전-언어 능력을 갖춘 플래그십이며 하이브리드 사고 모드가 기본으로 켜져 있고 100만 토큰 컨텍스트를 지원한다고 적었습니다. 8월 4일에는 Qwen-Image 3.0과 Pro 버전이 올라왔습니다. 10픽셀 단위의 정밀한 문자 렌더링과 12개 언어 지원이 특징으로 기재되어 있습니다.
6. 8월 13일에는 오픈소스 플래그십이 나왔습니다. qwen3.8-2.4t-a95b는 Qwen 최신 플래그십 계열의 오픈소스판으로, 희소 MoE 구조에서 총 2.4조 파라미터 가운데 스텝당 약 950억이 활성화되며 하이브리드 어텐션과 함께 100만 토큰 컨텍스트를 지원한다고 적혀 있습니다. 같은 날 deepseek-v4-pro-0813도 등재되었습니다. 총 1.6조 파라미터에 활성 490억, 네이티브 100만 토큰 컨텍스트라는 설명입니다.
7. 8월 19일에는 세 항목이 한꺼번에 올라왔습니다. qwen3.8-27b는 네이티브 비전-언어 dense 모델로 3.6-27B를 기반으로 코딩과 오피스 생산성 쪽이 개선되었으며, 텍스트와 시각 양쪽 모두에서 그렇다고 적혀 있습니다. 같은 날 Z.AI 직공급 GLM-5.3이 열렸고, kimi-k3가 싱가포르 리전에서 제공되기 시작했습니다. Kimi K3 항목에는 지금까지 가장 강력한 플래그십이며 항상 추론하고 사고 과정을 보존하며 텍스트와 이미지 입력, 대화와 에이전트 작업, 동적 도구 로딩을 지원한다고 기재되어 있습니다.
8. 임베딩 모델도 같은 달에 갱신되었습니다. 8월 11일 항목의 qwen3.7-text-embedding은 Qwen3.7 기반 다국어 벡터 모델이며, MTEB 다국어와 중국어-영어, 코드 검색 작업에서 이전 세대인 text-embedding-v4보다 20% 나은 성능을 낸다고 적혀 있습니다. 벡터 차원을 256에서 2560 사이로 조정할 수 있다는 설명도 붙어 있습니다.
9. Wan 계열의 이전 세대와 비교하면 통합이 핵심입니다. 같은 변경 로그를 위로 올려 보면 Wan 2.7 계열은 텍스트에서 영상, 이미지에서 영상, 참조물에서 영상, 영상 편집이 각각 별도 모델 이름으로 등재되어 있습니다. wan2.7-t2v와 wan2.7-i2v, wan2.7-r2v, wan2.7-videoedit이 따로 있었습니다. Wan 3.0 항목은 이 세 가지 생성 방식을 하나의 통합 모델에서 지원한다고 적었습니다. 모델을 골라 부르는 단계가 줄어드는 변화입니다.
10. 초대 전용에서 전체 공개까지의 간격이 짧습니다. 8월 6일 항목과 8월 24일 항목이 같은 모델을 가리킵니다. 초대 전용 테스트에서 공개 제공으로 넘어가는 데 18일이 걸렸습니다. 같은 페이지의 다른 항목들도 비슷한 속도로 갱신되고 있어서, 지금 정리한 모델 목록이 몇 주 뒤에는 그대로 통하지 않을 가능성을 계산에 넣어야 합니다.
11. 음성 모델도 같은 달에 함께 갱신되었습니다. 8월 10일 항목에는 qwen-audio-3.0-realtime-plus와 qwen-audio-3.0-realtime-flash가 올라왔습니다. 로그는 이 모델이 종단간 실시간 음성 모델이며 음성 추론과 양방향 대화 리듬을 함께 맞추고, 병렬 추론과 전방향 스트리밍 최적화로 종단간 응답 지연을 효과적으로 관리한다고 적었습니다. 영상 쪽에서 오디오 생성이 기능으로 들어온 흐름과 같은 방향에 있는 항목입니다.

아닌 것
완전히 새로 나온 모델이 아닙니다. Wan 3.0은 8월 6일 항목에 초대 전용 테스트로 이미 등장했습니다. 이번 8월 24일 항목은 그 모델이 공개 제공 상태로 바뀌었다는 기록입니다. 모델 구조나 성능이 이번에 달라졌다는 서술은 로그에 없습니다.
가격이 공개된 것이 아닙니다. 변경 로그의 Wan 3.0 항목에는 요금이나 과금 단위에 관한 표기가 없습니다. API 참조 문서 링크만 붙어 있습니다. 비용을 따져야 하는 팀은 별도 요금 페이지를 확인해야 합니다.
길이와 해상도 수치도 이 항목에는 없습니다. 같은 페이지의 다른 영상 모델 항목에는 3초에서 15초, 720P와 1080P 같은 수치가 적혀 있는데 Wan 3.0 항목에는 그런 값이 나오지 않습니다. 대신 길이를 알아서 정하는 기능이 특징으로 적혀 있습니다. 상한을 확인하려면 API 참조 문서를 봐야 합니다.
가중치가 공개된 것도 아닙니다. 로그의 Wan 3.0 항목은 API 제공을 기재했을 뿐이고 내려받을 수 있는 가중치에 관한 언급은 없습니다. 같은 페이지에서 Qwen 계열은 오픈소스판을 따로 표시해 두는데 이 항목에는 그런 표시가 없습니다.
벤치마크 승부 이야기도 아닙니다. 로그에는 Wan 3.0의 점수나 비교 대상이 나오지 않습니다. 어떤 모델보다 낫다는 주장이 없는 항목이므로, 품질 판단은 직접 돌려 보고 내리는 편이 맞습니다.
GLM-5.3 조건표와 같은 사안도 아닙니다. 8월 19일 항목에 GLM-5.3 직공급이 함께 적혀 있지만, 그 모델의 조건과 성능은 별개 사안입니다. 이번 소식의 중심은 영상 모델의 접근 조건이 초대 전용에서 전체 공개로 바뀐 대목입니다.
오늘 할 일
첫째, 세 가지 입력 방식을 같은 소재로 한 번씩 돌려 보십시오. 텍스트만 주는 경우, 첫 프레임만 주는 경우, 첫 프레임과 마지막 프레임을 함께 주는 경우, 그리고 참조물을 주는 경우를 같은 기획으로 비교해 두면 어느 방식이 우리 작업에 맞는지 빠르게 정리됩니다. 한 모델이 네 가지를 다 받으니 비교 조건을 맞추기도 쉽습니다.
둘째, 소리 전환을 기본값부터 확인하십시오. 오디오 생성이 기능으로 들어 있고 소리를 켜고 끄는 전환이 따로 있습니다. 무음이 필요한 자리에 소리가 붙어 나오면 후처리가 늘어나므로, 파이프라인의 기본값을 처음부터 정해 두는 편이 좋습니다.
셋째, 길이와 화면비 자동화가 우리 규격과 맞는지 재 보십시오. 모델이 길이와 화면비를 정해 준다는 것은 편할 때도 있고 곤란할 때도 있습니다. 플랫폼별 규격이 정해진 작업이라면 자동으로 나온 값이 규격 안에 들어오는지 표로 정리해 두는 편이 안전합니다.
넷째, 일반판과 고속판의 비용과 품질을 함께 적으십시오. wan3.0-video와 wan3.0-video-prime 사이의 차이를 로그는 속도로만 설명했습니다. 실제로는 초안 단계에 고속판, 최종 단계에 일반판을 쓰는 구성이 흔하게 나옵니다. 두 판을 같은 프롬프트로 돌려 결과와 시간을 같이 기록해 두십시오.
다섯째, 변경 로그 자체를 정기 확인 대상에 넣으십시오. 이 페이지는 8월 한 달에만 열 개 이상의 항목을 쌓았습니다. 모델 이름과 날짜, 리전 조건이 이 페이지에서 먼저 바뀌고 기사로는 나중에 나옵니다. 중국 모델을 쓰는 팀이라면 뉴스보다 이 로그가 빠릅니다.
여섯째, 결과물은 링크로 남기십시오. DAKER에는 25만 빌더와 339+ 대회, 29억+ 규모의 기록이 쌓여 있습니다. 영상 모델은 프롬프트와 결과를 함께 보여 주지 않으면 비교가 되지 않는 분야입니다. 같은 조건으로 돌린 짧은 비교 기록 하나가 다음 사람의 시간을 크게 줄여 줍니다. 올린 링크가 곧 제출입니다.
일곱째, 조달 조건을 리전 기준으로 다시 보십시오. 같은 로그에서 kimi-k3는 싱가포르 리전 제공으로 기재되었습니다. 중국 모델을 쓰는 경우 모델 이름만 맞추는 것으로는 부족하고 어떤 리전에서 호출되는지가 데이터 처리 규정과 직결됩니다. 팀에 데이터 소재 규정이 있다면 모델 선택보다 리전 확인이 먼저입니다.
출처: QwenCloud — Model releases changelog (2026-08-24 wan3.0-video GA / wan3.0-video-prime 항목)