过去用 AI 做半分钟短片,常常得先生成几段短镜头,再像拼布一样剪到一起。问题不只是麻烦:人物可能突然变脸,动作和情节也容易接不上。字节跳动发布的 Seedance 2.5 把单次生成时长拉到 30 秒,并已接入即梦 AI。所谓“原生直出”,就是模型一次生成完整时长,而不是靠外部工具拼接。
这件事值得注意,因为视频越长,时间一致性——人物外观、物体位置和运动在连续画面中保持稳定——就越难。30 秒已经足以容纳多次切镜和一段简单情节,竞争重点因此可能从“某个短镜头够不够漂亮”,转向“能不能把一件事连续讲清楚”。据量子位实测,其生成的营救短片采用约两秒一次的高密度切镜,并维持了人物特征;模型还支持局部编辑、最多参考 50 个素材,以及精度在一秒以内的时间戳指令。不过这些效果目前来自媒体体验,材料未提供标准化测试或跨模型对比。