分享好友 资讯首页 资讯分类 切换频道

Pika、Gen-2、ModelScope、SEINE……AI视频生成哪家强?这个框架一测便知

2024-01-22 20:51400

AI 视频生成,是最近最热门的领域之一。各个高校实验室、互联网巨头 AI Lab、创业公司纷纷加入了 AI 视频生成的赛道。PikaGen-2、Show-1、VideoCrafter、ModelScope、SEINE、LaVie、VideoLDM 等视频生成模型的发布,更是让人眼前一亮。v⁽ⁱ⁾

大家肯定对以下几个问题感到好奇:

为此,我们推出了 VBench,一个全面的「视频生成模型的评测框架」,来告诉你 「视频模型哪家强,各家模型强在哪」。

图片

VBench 不光能全面、细致地评估视频生成的效果,而且还特别符合人们的感官体验,能省下一大堆评估的时间和精力。

图片

AI 视频生成模型 - 评测结果

已开源的 AI 视频生成模型

各个开源的 AI 视频生成模型在VBench 上的表现如下。

图片

各家已开源的 AI 视频生成模型在 VBench 上的表现。在雷达图中,为了更清晰地可视化比较,我们将每个维度的评测结果归一化到了0.3与0.8之间。

图片

各家已开源的 AI 视频生成模型在 VBench 上的表现。

在以上6个模型中,可以看到 VideoCrafter-1.0和 Show-1在大多数维度都有相对优势。

创业公司的视频生成模型

VBench 目前给出了 Gen-2和 Pika 这两家创业公司模型的评测结果。

图片

Gen-2和 Pika 在 VBench 上的表现。在雷达图中,为了更清晰地可视化比较,我们加入了 VideoCrafter-1.0和 Show-1作为参考,同时将每个维度的评测结果归一化到了0.3与0.8之间。

图片

Gen-2和 Pika 在 VBench 上的表现。我们加入了 VideoCrafter-1.0和 Show-1的数值结果作为参考。

可以看到,Gen-2和 Pika 在视频质量(Video Quality)上有明显优势,例如时序一致性(Temporal Consistency)和单帧质量(Aesthetic Quality 和 Imaging Quality)相关维度。在与用户输入的 prompt 的语义一致性上(例如 Human Action 和 Appearance Style),部分维度开源模型会更胜一筹。

视频生成模型 VS 图片生成模型

图片

视频生成模型 VS 图片生成模型。其中 SD1.4,SD2.1和 SDXL 是图片生成模型。

视频生成模型在8大场景类别上的表现

下面是不同模型在8个不同类别上的评测结果。

图片

VBench 现已开源,一键即可安装

目前,VBench 已全面开源,且支持一键安装。欢迎大家来玩,测试一下感兴趣的模型,一起推动视频生成社区的发展。

图片

图片

图片

开源地址:https://github.com/Vchitect/VBench

图片

我们也开源了一系列 prompt List:https://github.com/Vchitect/VBench/tree/master/prompts,包含在不同能力维度上用于评测的 Benchmark,以及在不同场景内容上的评测 Benchmark。

图片

左边词云展示了我们 prompt Suites 的高频词分布,右图展示了不同维度和类别的 prompt 数量统计。

VBench 准不准?

针对每个维度,我们计算了 VBench 评测结果与人工评测结果之间的相关度,进而验证我们方法与人类观感的一致性。下图中,横轴代表不同维度的人工评测结果,纵轴则展示了 VBench 方法自动评测的结果,可以看到我们方法在各个维度都与人类感知高度对齐。

图片

VBench 带给 AI 视频生成的思考

VBench 不仅可以对现有模型进行评测,更重要的是,还可以发现不同模型中可能存在的各种问题,为未来 AI 视频生成的发展提供有价值的 insights。

「时序连贯性」以及「视频的动态程度」:不要二选一,而应同时提升

我们发现时序连贯性(例如 Subject Consistency、Background Consistency、Motion Smoothness)与视频中运动的幅度(Dynamic Degree)之间有一定的权衡关系。比如说,Show-1和 VideoCrafter-1.0在背景一致性和动作流畅度方面表现很好,但在动态程度方面得分较低;这可能是因为生成「没有动起来」的画面更容易显得 「在时序上很连贯」。另一方面,VideoCrafter-0.9在与时序一致性的维度上弱一些,但在 Dynamic Degree 上得分很高。

这说明,同时做好 「时序连贯性」和 「较高的动态程度」确实挺难的;未来不应只关注其中一方面的提升,而应该同时提升 「时序连贯性」以及 「视频的动态程度」这两方面,这才是有意义的。

分场景内容进行评测,发掘各家模型潜力

有些模型在不同类别上表现出的性能存在较大差异,比如在美学质量(Aesthetic Quality)上,CogVideo 在 「Food」类别上表现不错,而在 「LifeStyle」类别得分较低。如果通过训练数据的调整,CogVideo 在 「LifeStyle」这些类别上的美学质量是否可以提升上去,进而提升模型整体的视频美学质量?

这也告诉我们,在评估视频生成模型时,需要考虑模型在不同类别或主题下的表现,挖掘模型在某个能力维度的上限,进而针对性地提升 「拖后腿」的场景类别。

有复杂运动的类别:时空表现都不佳

在空间上复杂度高的类别,在美学质量维度得分都比较低。例如,「LifeStyle」类别对复杂元素在空间中的布局有比较高的要求,「Human」类别由于铰链式结构的生成带来了挑战。

对于时序复杂的类别,比如 「Human」类别通常涉及复杂的动作、「Vehicle」类别会经常出现较快的移动,它们在所有测试的维度上得分都相对较低。这表明当前模型在处理时序建模方面仍然存在一定的不足,时序上的建模局限可能会导致空间上的模糊与扭曲,从而导致视频在时间和空间上的质量都不理想。

难生成的类别:提升数据量收益不大

我们对常用的视频数据集 WebVid-10M 进行了统计,发现其中约有26% 的数据与 「Human」有关,在我们统计的八个类别中占比最高。然而,在评估结果中,「Human」类别却是八个类别中表现最差的之一。

这说明对于 「Human」这样复杂的类别,仅仅增加数据量可能不会对性能带来显著的改善。一种潜在的方法是通过引入 「Human」相关的先验知识或控制,比如 Skeletons 等,来指导模型的学习。

百万量级的数据集:提升数据质量优先于数据量

「Food」类别虽然在 WebVid-10M 中仅占据11%,但在评测中几乎总是拥有最高的美学质量分数。于是我们进一步分析了 WebVid-10M 数据集不同类别内容的美学质量表现,发现 「Food」 类别在 WebVid-10M 中也有最高的美学评分。

这意味着,在百万量级数据的基础上,筛选 / 提升数据质量比增加数据量更有帮助。

待提升的能力:准确生成生成多物体,以及物体间的关系

当前的视频生成模型在 「多对象生成」(Multiple Objects)和 「空间关系」(Spatial Relationship)方面还是追不上图片生成模型(尤其是 SDXL),这凸显了提升组合能力的重要性。所谓组合能力指的是模型在视频生成中是否能准确展示多个对象,及它们之间的空间及互动关系。

解决这一问题的潜在方法可能包括:

举报
收藏 0
打赏 0
评论 0
头 条 推 荐 ! 怎 么 买 斗 牛 房 卡 天 酷 大 厅 / 一 张 房 卡 多 少 钱 微 信 链 接
华盛顿--(美国商业资讯)--官方宣布:天酷大厅添加微信33549083通往2026年国际足联世界杯(FIFA World Cup 26?)的道路始于Visa。

0评论2026-04-242

正 版 授 权 ! 游 戏 推 荐 牛 牛 房 卡 出 售 先 锋 大 厅 / 新 道 游 / 房 卡 在 哪 里 购 买
日前,电池企业德加能源发公告称,先锋大厅/新道游咨询房/卡添加微信:88355042受锂电池原材料价格大幅上涨影响,电池生产成本提

0评论2026-04-242

金 花 创 建 房 间 / 牛 牛 房 卡 官 网 精 灵 大 厅 / 微 信 链 接 房 卡 从 哪 里 获 取
精灵大厅是一款非常受欢迎的棋牌游戏,咨询房/卡添加微信:【3329006910】或33549083许多玩家在游戏中会购买房卡来享受更好的游戏

0评论2026-04-242

微 信 金 花 / 牛 牛 房 卡 批 发 平 台 九 哥 联 盟 / 房 卡 在 哪 里 购 买
微信金花/牛牛房卡批发平台九哥联盟/房卡在哪里购买Sa9Ix苹果iPhone 17手机即将进入量产阶段。有消息称,富士康最大的iPhone手机

0评论2026-04-242

我 来 教 你 / 牛 牛 房 卡 游 戏 平 台 加 盟 天 龙 大 厅 / 房 卡 购 买 批 发 价 格
IT之家 消息,天龙大厅牛牛咨询房/卡添加微信:88355042市场调查机构 IDC 昨日发布博文,预测受苹果首款折叠屏 iPhone 及三星三折

0评论2026-04-242

牌 九 房 间 卡 / 牛 牛 房 卡 游 戏 代 理 新 竹 大 厅 / 房 卡 怎 么 弄
据了解,新竹大厅金花房卡添加微信33549083VARA大会是国内网络安全领域极具影响力的年度盛会,创办于2008年,是凝聚“政产学研用

0评论2026-04-242

牛 牛 创 建 房 间 / 牛 牛 房 卡 官 网 轩 辕 大 厅 / 房 卡 在 哪 里 购 买
华盛顿--(美国商业资讯)--官方宣布:轩辕大厅添加微信33549083通往2026年国际足联世界杯(FIFA World Cup 26?)的道路始于Visa。

0评论2026-04-242

我 来 教 你 / 牛 牛 房 卡 游 戏 平 台 加 盟 新 九 游 / 飞 鹰 互 娱 / 房 卡 批 发 市 场 价 格 表
日前,电池企业德加能源发公告称,新九游/飞鹰互娱咨询房/卡添加微信:88355042受锂电池原材料价格大幅上涨影响,电池生产成本提

0评论2026-04-242

玩 家 攻 略 , 金 花 房 卡 专 卖 店 天 王 大 厅 / 新 天 道 / 开 群 怎 么 买 房 卡
天王大厅/新天道是一款非常受欢迎的棋牌游戏,咨询房/卡添加微信:【3329006910】或33549083许多玩家在游戏中会购买房卡来享受更

0评论2026-04-242

正 规 平 台 有 哪 些 , 牛 牛 房 卡 批 发 平 台 星 云 大 厅 / 怎 么 充 值 获 取 房 卡
正规平台有哪些,牛牛房卡批发平台星云大厅/怎么充值获取房卡Sa9Ix苹果iPhone 17手机即将进入量产阶段。有消息称,富士康最大的i

0评论2026-04-242