让模型连续生成较长时长视频的能力。
长视频生成像画连载漫画:同一个主角连更几十话,不能上一格浓眉、下一格就换了张脸。
它能用来做广告、短剧和分镜预演。
Diffusion长视频生成通常建立在扩散式生成能力之上。
Multimodal AI它要同时理解文本、画面与时间连续性。
GPU视频越长、分辨率越高,对算力需求越重。
Seedance这类模型正把视频生成推进到更长片段。