Wan 3.0 génère des scènes, pas des plans.
Trente secondes d’images natives avec du son, en une seule génération. Des références image, vidéo et audio en un seul appel, avec toute la puissance de Magnific autour.
Un seul modèle. Le tournage complet.
Pas de modèles distincts pour le texte, l’image, la vidéo ou l’audio. Wan 3.0 d’Alibaba Cloud traite chaque référence en un seul appel, construit toute la prise et maintient chaque élément en place.
2–30s
Vidéo native de 2 à 30 secondes en une seule génération. Définissez la durée exacte, ou laissez la durée intelligente analyser votre contenu et décider.
Référencement universel
Jusqu’à 10 images, 5 clips et 5 pistes audio en un seul appel, avec une cohérence au pixel près entre les personnages, les accessoires, le son et la disposition spatiale.
Un texte qui reste du texte
Les interfaces, animations et textes à l’écran sont rendus comme du contenu structuré, et non comme une texture.
Format adaptatif
Cinq formats fixes du 16:9 au 9:16, plus un mode adaptatif : le modèle analyse votre contenu et choisit lui-même le cadrage.
Le son, natif par défaut.
L’audio est généré dans la même passe que l’image, en synchronisation dès la première image.
4K
Finaliser en 4K avec Magnific
Le modèle génère jusqu’en 1080p. Quand la prise est la bonne, l’outil pour améliorer la qualité vidéo de Magnific la finalise en 4K sans quitter la suite.


De la première référence au master en 4K
Wan 3.0 génère la scène. Magnific s’occupe de tout le reste, avant et après.
Image, vidéo, audio. Un seul appel.
Fournissez à Wan 3.0 jusqu’à 10 images, 5 clips et 5 pistes audio en une seule génération, combinés selon les besoins de la scène. Une cohérence au pixel près maintient l’ensemble : le personnage garde son visage, l’objet garde sa place, plan après plan.
Trente secondes. Une seule prise.
Trente secondes de vidéo native en une seule génération, image et son réunis. Réglez la seconde exacte dont vous avez besoin, ou laissez la durée intelligente lire l’histoire et décider. Le plan devient une scène.
Interfaces, titres et typographies qui tiennent la route.
Interfaces logicielles, animations et texte à l’écran sont générés comme du contenu structuré, lisible sur chaque image.
La prise arrive avec sa bande-son
Le son n’est pas une étape de post-production ici. Les effets et la musique sont générés dans le même passage que l’image, synchronisés avec ce qui se passe à l’écran. C’est activé par défaut. Désactivez-le lorsque le silence est le message.
Finalisez en 4K, directement dans Magnific.
Wan 3.0 génère des prises natives jusqu’en 1080p. Choisissez la meilleure, passez-la dans l’outil pour améliorer la qualité d’une image de Magnific, et livrez en 4K sans quitter la suite. Rien n’a besoin d’être retourné.


D’un prompt à une scène terminée
Publicité
Un spot de 30 secondes en une seule génération, avec produit, bande-son et rythme calés dès la première image.
E-commerce
Des mises en avant produit avec le produit exact. Référencez les plans que vous avez déjà et conservez chaque détail en place.
Réseaux sociaux
Des reels qui arrivent avec leur bande-son. Effets et musique inclus, sans passage audio.
Film & Originals
Des micro-drames et des scènes d’action avec de l’espace pour respirer : tout un arc narratif en une seule génération.
Studios et agences
Une configuration Spaces reproductible, packagée sous forme de flow, pour un résultat que toute votre équipe peut reproduire.
Bloquer la caméra en 3D
Mettez en scène le mouvement dans Scènes 3D, puis confiez-le à Wan 3.0 comme l’une de ses références vidéo. Vous dirigez la caméra avant même de lancer la moindre génération.
Questions fréquentes
- Wan 3.0 est le nouveau modèle vidéo tout-en-un d’Alibaba Cloud. Plus de variantes séparées texte-vers-vidéo, image-vers-vidéo ou montage : un seul appel prend en charge toutes les entrées. En plus de cela, génération native de 30 secondes, son rendu en même temps que l’image, et référencement universel avec une cohérence au pixel près.
- De 2 à 30 secondes, nativement. La durée intelligente peut analyser votre prompt et vos éléments pour déterminer la longueur à votre place.
- Oui. L’audio est généré dans la même passe que la vidéo et est activé par défaut. Désactivez-le lorsque vous souhaitez du silence.
- Jusqu’à 10 images, 5 clips vidéo et 5 pistes audio en un seul appel, combinés selon les besoins de la scène, avec une cohérence au pixel près entre les personnages, les objets, le son et l’espace.
- 16:9, 4:3, 1:1, 3:4 et 9:16, ainsi qu’un format adaptatif : le modèle choisit le cadrage en fonction de votre intention et de vos éléments.
- Wan 3.0 génère jusqu’à 1080p. Dans Magnific, vous finalisez en 4K avec l’outil pour améliorer la qualité vidéo, au même endroit où vous avez créé les références et choisi la prise.
- Oui. Exécutez Wan 3.0 depuis Claude, ChatGPT, Cursor ou vos propres applications via l’API et le MCP de Magnific, avec vos crédits Magnific habituels.
Créé avec Wan 3.0
Des restrictions régionales s’appliquent. Soumis à la politique d’utilisation acceptable.

