Arrastra y suelta archivos multimedia desde tu ordenador, pégalos desde el portapapeles (Ctrl/Cmd+V) o proporciona una URL. Aceptado: .jpg, .jpeg, .png, .webp
Listo para generar
Configure sus entradas y haga clic en ejecutar para generar una vista previa de la imagen.
Veo 3.1 es el modelo de generación de videos de máximo nivel que reúne lo más avanzado de la tecnología de IA de Google DeepMind. Cuenta con la función «Ingredientes para video», que combina múltiples imágenes de referencia para construir historias, y crea videos fluidos e ininterrumpidos manteniendo al máximo la coherencia de personajes y objetos.
Su característica más destacada es la función de generación de audio de alta precisión que se sincroniza nativa y completamente con el video. Permite lograr diálogos naturales, sonidos ambientales envolventes, música de fondo adecuada para cada situación y un lip sync perfecto todo en un solo paso. Además, responde con precisión a las indicaciones de movimiento cinematográfico de cámara (como el zoom de dron o el lapso de tiempo) y expresa texturas realistas que simulan fielmente las leyes de la física.
También es compatible de forma nativa con el formato vertical (9:16), lo que permite crear de manera eficiente contenido de alta calidad que satisfaga las necesidades profesionales, desde redes sociales, materiales publicitarios, creación de guiones gráficos hasta la producción de videos de gran formato.
| Resolución | Créditos consumidos |
|---|---|
| 720p(credits/s) | 6 |
| 1080p(credits/s) | 9 |
| Parámetro técnico | Especificación |
|---|---|
| Capacidad principal | Imagen de referencia a video |
| Resolución | 720p,1080p |
| Relación de aspecto | 16:9 |
| Duración | 8 |

BytePlus
Un modelo generativo multimodal innovador que crea videos de nivel cinematográfico de hasta 30 segundos a partir de una imagen de referencia.

BytePlus
Modelo de generación de vídeo ligero que crea rápidamente vídeos de alta calidad a partir de retratos de referencia

WAN
Un modelo de nueva generación que transforma imágenes fijas y audio en videos de calidad cinematográfica con una velocidad abrumadora

El modelo generador y editor de vídeo multimodal rápido de Google, que combina audio y vídeo de forma avanzada

WAN
Next-generation integrated AI video generation model that achieves cinematic image quality and high consistency

Kling
Un modelo de generación de videos versátil de nivel cinematográfico que reproduce personajes consistentes a partir de imágenes