字节和UCLA联合提出的新方法——Self-Forcing++,无需更换模型架构或重新收集长视频数据集,就能轻松生成分钟级长视频,也不会后期画质突然变糊或卡住。 通过利用教师知识和自生成视频片段指导自回归生成,最长生成视频可达4分15秒,而且高质量、还开源。
不止1分钟
资源越多肯定能越长。现在为了节省成本,限制了时长。
@xiaobindiy #1 @onewater #2 几分钟?
反正就是几分钟
@zjkal #4 好的
为什么我看到有的sora2生成的视频很长而且还很清晰,我试了下却不行啊
@霓虹捕手 #6 仿的吧
一个小时多也见过
@Hoog #7 仿的还带个sora2的水印吗
字节和UCLA联合提出的新方法——Self-Forcing++,无需更换模型架构或重新收集长视频数据集,就能轻松生成分钟级长视频,也不会后期画质突然变糊或卡住。
通过利用教师知识和自生成视频片段指导自回归生成,最长生成视频可达4分15秒,而且高质量、还开源。