准备生成
配置输入并点击运行以生成图片预览。
Seedance 2.0是字节跳动Seed团队研发的电影级多模态音视频联合生成模型,采用创新双分支扩散变换器(DB-DiT)架构,支持文本、图片、音频、视频四模态混合输入,可加载最多9张图、3段视频、3段音频共12个参考文件,以单次前向传播同步输出2K分辨率视频与原生双声道立体声,彻底解决音画时序错位、口型不同步等行业痛点;模型具备强大3D空间感知与动态记忆能力,运动稳定、物理拟真、主体一致性极强,能自动完成多镜头叙事、分镜设计与流畅运镜,精准还原复杂脚本与导演级创作意图,在指令遵循、画面美感、音频还原等维度均处行业领先,深度适配影视、广告、社媒营销等专业场景,可高效产出符合工业交付标准的高质量视听内容,大幅降低内容创作成本与周期。
| 图像分辨率 | 消耗积分(credits) |
|---|---|
| 4k(credits/s) | 66 |
| 480p(credits/s) | 6 |
| 720p(credits/s) | 14 |
| 1080p(credits/s) | 32 |
| 技术参数 | 具体规格 |
|---|---|
| 核心能力 | 文本到视频 |
| 分辨率 | 480p,720p,1080p,4k |
| 比例 | 16:9,4:3,1:1,3:4,9:16,21:9 |
| 时长 | 4,5,6,7,8,9,10,11,12,13,14,15 |

BytePlus
最长可生成30秒、音画同步的电影级视频,是专业级高性能视频生成模型

BytePlus
实现了压倒性的生成速度与高品质兼备的轻量视频生成模型

WAN
以惊人速度生成最长30秒的电影级影像的下一代多模态视频生成模型

可自由融合文本与音频,高速生成连贯一致的高质量视频的最新模型。

WAN
具备电影级画质与高级控制能力的下一代AI视频生成模型

Google DeepMind引以为傲的尖端AI视频生成模型。可生成电影级视频及同步音效。