基于文本生成可变长度的视频模型发布Phenaki
625 阅读
今天Meta AI刚发布了最新的Text-to-Video模型Make-A-Video之后,也有研究人员公布了一个更加吸引人的模型Phenaki,由于这篇论文投稿至ICLR2023,正在盲审,因此没有公布作者,不过官网已经发出。从官网的的宣传看,这个模型十分惊艳,其主要特点包括:
1、细节处理十分到位,生成的视频中,不论是在水下还是在清晨阳光里,水纹与光影效果突出!

2、这个模型可以从一个静态图片与一段文本描述生成视频,也就是以图片为基础,根据文本描述生成视频。

3、最重要的是它可以生成比较长的视频,官网展示了一个2分钟的长视频,效果很赞。
DataLearner 官方微信
欢迎关注 DataLearner 官方微信,获得最新 AI 技术推送
