メディアファイルをドラッグ&ドロップ、クリップボードから貼り付け(Ctrl/Cmd+V)、またはURLを入力してください。対応形式: .jpg, .jpeg, .png, .webp
生成準備完了
画像プレビューを生成するには、入力項目を設定して「実行」をクリックしてください。
Seedance 2.0 es un modelo de cogeneración de audio y video multimodal cinematográfico desarrollado por el equipo Seed de ByteDance. Emplea una innovadora arquitectura de transformador de difusión de doble rama (DB-DiT), que admite la entrada mixta de cuatro modalidades: texto, imágenes, audio y video. Puede cargar hasta 12 archivos de referencia, incluyendo 9 imágenes, 3 videoclips y 3 clips de audio, y genera video con resolución 2K y sonido estéreo nativo en una sola propagación directa, resolviendo por completo problemas comunes de la industria como la desalineación de la sincronización audiovisual y la asincronía de la sincronización labial. El modelo posee una potente capacidad de reconocimiento espacial 3D y memoria dinámica, lo que se traduce en un movimiento estable, realismo físico y una gran coherencia del sujeto. Puede completar automáticamente narrativas de múltiples tomas, diseño de guiones gráficos y movimientos de cámara fluidos, reproduciendo con precisión guiones complejos e intenciones creativas a nivel de director. Es líder en la industria en cumplimiento de instrucciones, estética visual y reproducción de audio, adaptándose profundamente a escenarios profesionales como el cine, la publicidad y el marketing en redes sociales. Puede producir de forma eficiente contenido audiovisual de alta calidad que cumpla con los estándares de entrega de la industria, reduciendo significativamente los costos y los plazos de creación de contenido.
| Resolución | Créditos consumidos |
|---|---|
| 4k(credits/s) | 66 |
| 480p(credits/s) | 6 |
| 720p(credits/s) | 14 |
| 1080p(credits/s) | 32 |
| Parámetro técnico | Especificación |
|---|---|
| Capacidad principal | Imagen de referencia a video |
| Resolución | 480p,720p,1080p,4k |
| Relación de aspecto | 16:9,4:3,1:1,3:4,9:16,21:9 |
| Duración | 4,5,6,7,8,9,10,11,12,13,14,15 |

BytePlus
Un modelo generativo multimodal innovador que crea videos de nivel cinematográfico de hasta 30 segundos a partir de una imagen de referencia.

BytePlus
Modelo de generación de vídeo ligero que crea rápidamente vídeos de alta calidad a partir de retratos de referencia

WAN
Un modelo de nueva generación que transforma imágenes fijas y audio en videos de calidad cinematográfica con una velocidad abrumadora

El modelo generador y editor de vídeo multimodal rápido de Google, que combina audio y vídeo de forma avanzada

WAN
Next-generation integrated AI video generation model that achieves cinematic image quality and high consistency

El modelo de generación de videos de Google más avanzado, que crea imágenes y sonido de calidad cinematográfica