¡30% de descuento por tiempo limitado!Obtener oferta
N.º 1 en texto a video con audio de Artificial Analysis — septiembre de 2026

Wan 3.0: dirige una escena completa, con voces

Escribe una frase, sube un fotograma o añade varias referencias y recibe hasta 30 segundos de video terminado, con diálogo, música y labios sincronizados.

Prueba el modo AgentNEW

Describe tu idea en una conversación y sigue afinándola.

Probar Agent
Subir archivosObligatorio
Fotograma inicial
Fotograma final
  • Imágenes: JPG, PNG o WebP
Duration (seconds)5s
2s16s30s

Vista previa

5s Living Oil Painting | 16:9 | Impressionist Post-Painterly Texture | Sea-Cliff Wind and Scattering Blossoms FIRST FRAME: strictly preserve the reference image's original composition, palette, and brushwork. Nothing is re-rendered as photoreal — the animation must look like an oil painting in motion, visible impasto strokes and palette-knife ridges holding their identity as they move. SUBJECT: young dark-haired woman in a sage-olive long-sleeved blouse with a patterned sash, head tilted down and to her right, eyes lowered, expression calm and inward. Both bare forearms lift toward a great bundle of white chrysanthemum blooms breaking apart in the air before her. Face structure, hair mass, sleeve folds, and skin tone stay consistent throughout.
Ejemplos oficiales

Dentro de las demos oficiales de Wan 3.0

Videos del lanzamiento oficial de Alibaba: una toma larga y continua, actuación de personajes y escala cinematográfica.

Una toma larga, sin cortes

Un querubín sube una escalera de caracol entre las nubes en una toma continua: el tipo de secuencia larga y coherente para el que se diseñó el modelo.

Generar una toma larga
Un querubín sube una escalera de mármol en espiral entre las nubes: una toma larga y continua de Wan 3.0

Actuación de personajes consistente

Un personaje estilizado asalta el refrigerador de noche. Expresión, movimiento e iluminación se mantienen durante toda la escena.

Animar un personaje
Demo de video con IA Wan 3.0: un personaje estilizado abre el refrigerador de noche

Escala de cinemática de videojuego

Ruinas iluminadas por faroles, un Buda de piedra gigante y un guerrero: una cinemática de 30 segundos creada directamente por el modelo.

Crear una cinemática
Demo de generación Wan 3.0: un guerrero ante un Buda de piedra gigante en ruinas iluminadas por faroles

¿Qué es Wan 3.0?

Wan 3.0 es el modelo de video integral de Alibaba: texto a video, imagen a video, generación con referencias, edición y extensión en un solo modelo. Dale una frase o un primer fotograma y genera hasta 30 segundos en hasta 1080p. El audio es nativo: diálogo, efectos y música llegan en la misma generación y la voz mueve los labios del personaje. En septiembre de 2026 ocupaba el puesto #1 de texto a video con audio de Artificial Analysis, con Elo 1242, por delante de Gemini Omni Flash y MiniMax H3 Max.

Controles

Wan 3.0 reúne los controles que necesita la escena

  • De 2 a 30 segundos en una generación

    Elige cualquier duración en segundos enteros, con 5 por defecto, o deja que el modelo elija la duración adecuada a la acción.

  • Hasta 1080p a 30 FPS

    Empieza en 480p para probar versiones y genera la definitiva en 1080p. Todos los videos mantienen 30 FPS.

  • Sonido nativo

    Diálogo, efectos ambientales y música se generan con la imagen; las frases habladas dirigen los labios.

  • Cinco proporciones o ajuste adaptativo

    16:9, 4:3, 1:1, 3:4 o 9:16, o deja el encuadre en modo adaptativo.

  • Hasta 20 referencias

    Añade imágenes, videos y audio, e incluso un PDF, una presentación o una página web. El modelo usa todo para construir la escena.

  • Editar y extender

    Sustituye elementos, cambia el estilo de una toma, reescribe una frase del personaje o añade tiempo antes o después del video, hasta 30 segundos en total.

Flujo

Cómo crear un video con IA en Wan 3.0

  1. 1

    Plantea la escena

    Escribe qué sucede o sube un fotograma inicial, uno final o varias referencias.

  2. 2

    Ajusta el encuadre

    Elige de 2 a 30 segundos, de 480p a 1080p y una proporción entre 16:9 y 9:16, o deja la duración en automático.

  3. 3

    Genera con sonido

    El video llega con voces, efectos y música. Consérvalo, edita una frase o amplía la toma.

Casos de uso

Qué crean los equipos con Wan 3.0

Reúne en una generación lo que antes requería varias herramientas.

  • Equipos de publicidad

    Un anuncio completo de 30 segundos, con imagen, voz en off y música, desde un solo encargo y con tantas versiones como necesites probar.

  • Marketing de producto

    Imagen a video desde una foto principal: el producto abre la escena y el modelo lo pone en movimiento.

  • Educadores y creadores de explicaciones

    Convierte un PDF, una presentación o una página web en un video explicativo narrado sin preparar antes un storyboard.

  • Creadores para redes

    Escenas verticales 9:16 con diálogo audible y labios sincronizados, listas para publicar.

  • Equipos de narrativa y videojuegos

    Secuencias cinematográficas con personajes consistentes, planteadas toma a toma y ampliadas escena a escena.

Salto de generación

Wan 3.0 frente a la generación anterior de Wan

Qué cambió respecto a la línea de API Wan 2.7, según el anuncio de Alibaba.

Este sitioWan 3.0La generación integralGenerarWan 2.7Generación anterior de la API
Duración máxima en una generaciónHasta 30 segundosLímite de 15 segundos
Organización del modeloReferencias, edición, generación y extensión en un modeloFunciones repartidas entre modelos separados
EntradasTexto y fotogramas, más hasta 20 referencias, incluidos documentos y páginas webMenos tipos de entrada
Precios

Precios de Wan 3.0 por créditos

Las suscripciones cargan créditos en tu cuenta. Por $19.90 recibes 1,000: 25 borradores de cinco segundos o 6 tomas de diez segundos en 720p.

Oferta por tiempo limitado30% de descuento

¡30% de descuento por tiempo limitado!

07días00h00min00s
Loading…
Preguntas

Respuestas sobre Wan 3.0

Una generación. Una escena completa que habla.

Conserva la toma, reescribe una frase o amplía el final. Tu primera escena empieza con un prompt.