알리바바 Wan 3.0 전체 공개, 8월 24일 변경 로그에서 확인된 내용 | DAKER 커뮤니티
영상 생성 모델은 성능 자체만큼이나 접근 조건의 변화가 중요합니다. 초대 전용으로만 열려 있던 모델이 전체 공개로 전환되는 순간, 실험 단계에 머물던 도구가 바로 실무 후보로 들어오기 때문입니다. 이번 QwenCloud 변경 로그의 2026년 8월 24일 항목은 그런 전환점에 가깝습니다.
알리바바의 Wan 3.0은 완전히 새로 등장한 모델이라기보다, 이미 8월 6일에 초대 전용 테스트로 올라왔던 모델이 일반 제공 상태로 바뀐 사례입니다. 같은 날 고속 변형까지 함께 등재되면서, 이제는 품질과 속도를 나눠 비교할 수 있는 조건도 갖춰졌습니다.
8월 24일 변경 로그의 핵심은 Wan 3.0의 첫 등장이 아니라 초대 전용에서 전체 공개로 전환됐다는 점입니다.

8월 24일에 실제로 바뀐 것
QwenCloud 모델 변경 로그의 QwenCloud 모델 변경 로그에는 2026년 8월 24일자로 두 항목이 올라왔습니다. wan3.0-video는 일반 제공 상태로 기재됐고, wan3.0-video-prime은 같은 기능을 제공하는 고속 변형으로 함께 등재됐습니다.
로그 설명에 따르면 wan3.0-video는 8월 6일 초대 전용 테스트로 시작했고, 이번에 공개적으로 사용할 수 있는 상태가 됐습니다. 초대 전용에서 전체 공개까지 걸린 시간은 18일입니다. 3주가 채 되지 않는 속도입니다.
Wan 3.0은 8월 6일 초대 전용 테스트로 등장했고, 8월 24일 일반 제공 상태로 전환됐습니다.
Wan 3.0이 지원한다고 적힌 기능
이번 항목에서 가장 눈에 띄는 부분은 통합 방식입니다. 로그는 Wan 3.0을 올인원 영상 생성 모델로 설명합니다. 텍스트로 영상을 만드는 방식, 이미지로 영상을 만드는 방식, 참조물을 활용하는 방식이 하나의 모델 안에 함께 들어 있습니다.
이미지 기반 생성은 두 경우가 따로 적혀 있습니다. 첫 프레임만 주는 경우와 첫 프레임과 마지막 프레임을 함께 주는 경우입니다. 시작과 끝을 정해 두고 중간을 채우는 작업을 별도 모델 없이 처리할 수 있다는 뜻입니다.
기능 이름으로는 오디오 생성, 소리를 켜고 끄는 전환, 길이를 알아서 정하는 기능, 화면비를 상황에 맞추는 기능이 명시돼 있습니다. 영상과 소리를 분리해 다루는 흐름이 아니라, 소리까지 한 번에 생성하는 구조라는 점이 드러납니다.
Wan 3.0은 텍스트, 이미지, 참조물 기반 생성을 하나의 통합 모델에서 지원한다고 적혀 있습니다.
같은 날 올라온 고속 변형의 의미
wan3.0-video-prime은 Wan 3.0의 고속 변형으로 기재됐습니다. 변경 로그는 이 모델이 wan3.0-video와 같은 올인원 기능을 제공하면서 생성 속도가 더 빠르다고만 설명합니다.
공개된 설명만 놓고 보면, 두 모델의 차이는 우선 속도에 있습니다. 그래서 이 구성을 품질 확인용과 회전 수 확보용으로 나눠 쓰라는 신호로 읽을 수 있습니다. 다만 로그에는 품질 차이나 비용 차이에 대한 수치가 없으므로, 실제 판단은 직접 비교해 보는 편이 맞습니다.
Wan 2.7과 비교해 보이는 변화
같은 변경 로그에서 이전 세대인 Wan 2.7 계열을 보면, 텍스트에서 영상, 이미지에서 영상, 참조물에서 영상, 영상 편집이 각각 별도 모델 이름으로 나뉘어 있습니다. wan2.7-t2v, wan2.7-i2v, wan2.7-r2v, wan2.7-videoedit이 따로 있었습니다.
반면 Wan 3.0 항목은 세 가지 생성 방식을 하나의 통합 모델에서 지원한다고 적고 있습니다. 모델을 고르는 단계가 줄어드는 방향으로 바뀐 셈입니다.
Wan 계열의 이번 변화에서 핵심은 새 기능의 추가보다 여러 입력 방식을 한 모델로 통합한 점에 있습니다.
이번 소식이 아닌 것
이번 변경 로그를 읽을 때는 범위를 분명히 해 두는 것이 좋습니다. 우선 Wan 3.0은 이번에 처음 나온 모델이 아닙니다. 8월 6일에 이미 초대 전용 테스트로 등장했고, 8월 24일에는 접근 조건이 바뀐 것입니다.
또한 가격 정보는 이번 항목에 없습니다. 요금이나 과금 단위는 적혀 있지 않고 API 참조 문서 링크만 붙어 있습니다. 비용을 따져야 하는 경우에는 별도 요금 페이지를 확인해야 합니다.
길이와 해상도 수치도 이 항목에는 없습니다. 같은 페이지의 다른 영상 모델에는 3초에서 15초, 720P와 1080P 같은 값이 적혀 있는 경우가 있지만, Wan 3.0 항목에는 그런 수치가 보이지 않습니다. 대신 길이를 알아서 정하는 기능이 특징으로 적혀 있습니다.
가중치 공개에 대한 언급도 없습니다. 이 항목은 API 제공 사실을 기록한 것이며, 내려받을 수 있는 오픈 가중치가 공개됐다는 뜻은 아닙니다. 벤치마크 점수나 비교 우위 주장도 없습니다. 어떤 모델보다 낫다는 식의 서술은 로그에 나오지 않습니다.
이번 변경 로그는 접근 조건의 변경을 알리는 기록이지, 가격·가중치·벤치마크를 함께 공개한 문서는 아닙니다.

8월 전체 흐름 속에서 보면
Wan 3.0 공개 전환은 8월의 더 큰 흐름 안에 놓여 있습니다. 같은 변경 로그 페이지를 보면 8월 항목이 유난히 촘촘합니다.
8월 3일에는 Qwen3.8 Max가 등재됐고, 로그는 2.4조 파라미터 규모의 MoE 구조에 네이티브 비전-언어 능력을 갖춘 플래그십이며 하이브리드 사고 모드가 기본으로 켜져 있고 100만 토큰 컨텍스트를 지원한다고 적었습니다. 8월 4일에는 Qwen-Image 3.0과 Pro 버전이 올라왔고, 10픽셀 단위의 정밀한 문자 렌더링과 12개 언어 지원이 특징으로 기재됐습니다.
8월 10일에는 qwen-audio-3.0-realtime-plus와 qwen-audio-3.0-realtime-flash가 올라왔습니다. 로그는 이 모델들이 종단간 실시간 음성 모델이며 음성 추론과 양방향 대화 리듬을 함께 맞추고, 병렬 추론과 전방향 스트리밍 최적화로 종단간 응답 지연을 효과적으로 관리한다고 설명합니다.
8월 11일에는 qwen3.7-text-embedding이 등재됐습니다. Qwen3.7 기반 다국어 벡터 모델이며, MTEB 다국어와 중국어-영어, 코드 검색 작업에서 이전 세대인 text-embedding-v4보다 20% 나은 성능을 낸다고 적혀 있습니다. 벡터 차원을 256에서 2560 사이로 조정할 수 있다는 설명도 붙어 있습니다.
8월 13일에는 qwen3.8-2.4t-a95b와 deepseek-v4-pro-0813이 올라왔습니다. 전자는 Qwen 최신 플래그십 계열의 오픈소스판으로, 희소 MoE 구조에서 총 2.4조 파라미터 가운데 스텝당 약 950억이 활성화되며 하이브리드 어텐션과 함께 100만 토큰 컨텍스트를 지원한다고 적혀 있습니다. 후자는 총 1.6조 파라미터에 활성 490억, 네이티브 100만 토큰 컨텍스트라는 설명입니다.
8월 19일에는 세 항목이 한꺼번에 올라왔습니다. qwen3.8-27b는 네이티브 비전-언어 dense 모델로 3.6-27B를 기반으로 코딩과 오피스 생산성 쪽이 개선됐다고 적혀 있습니다. 같은 날 Z.AI 직공급 GLM-5.3이 열렸고, kimi-k3는 싱가포르 리전에서 제공되기 시작했습니다. Kimi K3 항목에는 지금까지 가장 강력한 플래그십이며 항상 추론하고 사고 과정을 보존하며 텍스트와 이미지 입력, 대화와 에이전트 작업, 동적 도구 로딩을 지원한다고 기재돼 있습니다.
이 흐름을 보면, 8월 24일의 Wan 3.0 공개 전환은 단독 이벤트라기보다 QwenCloud가 짧은 주기로 모델 접근성과 라인업을 계속 갱신하고 있다는 신호에 가깝습니다.
지금 확인해 볼 만한 지점
실제로 이 모델을 검토하는 팀이라면 몇 가지를 먼저 확인해 두는 것이 좋습니다. 같은 기획으로 텍스트 입력, 첫 프레임만 주는 방식, 첫 프레임과 마지막 프레임을 함께 주는 방식, 참조물을 주는 방식을 나란히 비교하면 어떤 입력 방식이 작업에 맞는지 빠르게 드러납니다.
오디오 생성과 소리 전환도 초기에 확인할 필요가 있습니다. 무음이 필요한 작업에 기본값으로 소리가 붙어 나오면 후처리 부담이 커질 수 있기 때문입니다.
길이와 화면비 자동화는 편리하지만, 플랫폼별 규격이 엄격한 작업에서는 오히려 확인 항목이 됩니다. 자동으로 나온 결과가 실제 배포 규격 안에 들어오는지 먼저 보는 편이 안전합니다.
또한 wan3.0-video와 wan3.0-video-prime은 같은 프롬프트로 결과와 시간을 함께 기록해 두는 것이 좋습니다. 변경 로그는 속도 차이만 설명하고 있으므로, 실제 품질과 비용 차이는 직접 비교해야 판단할 수 있습니다.
마지막으로, 이 페이지 자체를 정기적으로 보는 편이 유용합니다. 같은 로그에서 kimi-k3가 싱가포르 리전 제공으로 기재된 것처럼, 모델 이름뿐 아니라 리전 조건도 함께 바뀌기 때문입니다. 특히 중국 모델을 검토하는 경우에는 접근 가능 여부보다 어떤 리전에서 호출되는지가 더 중요해질 수 있습니다.
참고 자료
https://docs.qwencloud.com/changelog/models
여러분은 Wan 3.0처럼 입력 방식을 통합한 영상 모델이 실제 작업 흐름을 얼마나 단순하게 만든다고 보시는지 궁금합니다.