Wan 3.0 genera escenas, no solo planos.
Treinta segundos de vídeo nativo con sonido, en una sola generación. Referencias de imagen, vídeo y audio en una sola llamada, y toda la suite de Magnific a su alrededor.
Un modelo. Todo el rodaje.
Sin modelos separados para entradas de texto, imagen, vídeo o audio. Wan 3.0 de Alibaba Cloud procesa cada referencia en una sola llamada, configura todo el proceso y se encarga del resultado.
2–30s
Vídeo nativo de 2 a 30 segundos en una sola generación. Define la duración exacta o deja que la duración inteligente lea el material y decida.
Referencias universales
Hasta 10 imágenes, 5 clips y 5 pistas de audio en una sola llamada, con coherencia a nivel de píxel entre personajes, objetos, sonido y disposición espacial.
El texto que se queda como texto
Las interfaces, las animaciones y el texto en pantalla se renderizan como contenido estructurado, no como textura.
Relación de aspecto adaptativa
Cinco relaciones de aspecto fijas de 16:9 a 9:16, más una opción adaptativa: el modelo lee el material y elige el encuadre por sí mismo.
Sonido nativo por defecto.
El audio se renderiza en la misma pasada que la imagen, sincronizado desde el primer fotograma.
4K
Masteriza en 4K con Magnific
El modelo renderiza hasta 1080p. Cuando la escena está lista, el upscaler de vídeo de Magnific la masteriza en 4K sin salir de la suite.


Desde la primera referencia hasta el máster en 4K
Wan 3.0 genera la escena. Magnific se encarga de todo lo demás, antes y después.
Imagen, vídeo, audio. Una sola llamada.
Aporta a Wan 3.0 hasta 10 imágenes, 5 clips y 5 pistas de audio en una sola generación, combinadas como la escena lo necesite. La coherencia a nivel de píxel lo mantiene todo unido: el personaje conserva el rostro, el objeto conserva su lugar, plano tras plano.
Treinta segundos. Una sola pasada.
Treinta segundos de vídeo nativo en una sola generación, con imagen y sonido a la vez. Define los segundos exactos que necesitas o deja que la duración inteligente interprete la historia y decida por ti. El plano se convierte en una escena.
Interfaces, títulos y textos que se mantienen nítidos.
Las interfaces de software, las animaciones y el texto en pantalla se renderizan como contenido estructurado, legible en cada fotograma.
El plano, con su banda sonora
El sonido no tiene por qué ser un añadido de postproducción. Los efectos y la música se renderizan en la misma pasada que la imagen, sincronizados con lo que ocurre en pantalla. Está activado por defecto. Desactívalo cuando quieras silencio.
Finaliza en 4K, dentro de Magnific.
Wan 3.0 renderiza planos nativos de hasta 1080p. Elige el mejor, pásalo por el upscaler de Magnific y consíguelo en 4K sin salir de la suite. No tendrás que regrabar nada.


De un prompt a una escena terminada
Publicidad
Un anuncio de 30 segundos en una sola generación, con el producto, la banda sonora y el ritmo fijados desde el primer fotograma.
Comercio electrónico
Imágenes principales con el producto exacto. Usa como referencia las tomas que ya tienes y conserva cada detalle en su sitio.
Redes sociales
Reels que llevan su propia banda sonora. Efectos y música incluidos, sin necesidad de una pasada de audio.
Cine y contenido original
Microdramas y escenas de acción con espacio para respirar: un arco completo en una sola generación.
Estudios y agencias
Una configuración de Spaces reproducible, contenida en forma de flow, para obtener resultados que todo tu equipo pueda repetir.
Posiciona la cámara en 3D
Prepara el movimiento en Escenas 3D y pásaselo a Wan 3.0 como una de sus referencias de vídeo. Tú diriges la cámara antes de gastar ningún crédito en generar.
Preguntas frecuentes
- Wan 3.0 es el nuevo modelo de vídeo todo en uno de Alibaba Cloud. Sin variantes independientes de texto a vídeo, imagen a vídeo o edición: una sola llamada admite cualquier tipo de entrada. Además, incluye generación nativa de 30 segundos, sonido renderizado junto con la imagen y referencias universales con coherencia a nivel de píxel.
- De 2 a 30 segundos de forma nativa. La duración inteligente puede interpretar el prompt y el material para definir la duración por ti.
- Sí. El audio se genera en la misma pasada que el vídeo y está activado de forma predeterminada. Desactívalo cuando quieras silencio.
- Hasta 10 imágenes, 5 clips de vídeo y 5 pistas de audio en una sola llamada, combinados como la escena lo requiera, con coherencia a nivel de píxel entre personajes, objetos, sonido y espacio.
- 16:9, 4:3, 1:1, 3:4 y 9:16, además de adaptativo: el modelo elige el encuadre según la intención y el material.
- Wan 3.0 genera hasta 1080p. Dentro de Magnific, puedes conseguir 4K con el upscaler de vídeo, en el mismo lugar donde creaste las referencias y elegiste la toma.
- Sí. Ejecuta Wan 3.0 desde Claude, ChatGPT, Cursor o tus propias apps a través del MCP y la API de Magnific, con tus créditos habituales de Magnific.
Creado con Wan 3.0
Se aplican restricciones regionales. Sujeto a la Política de uso aceptable.

