文章摘要
8月视频生成模型赛道集中爆发,多款新模型上线。测试选取Minimax H3、Seedance 2.0 fast、Wan 3.0,从输出质量等四维度评估。多组测试显示,Seedance 2.0 fast综合表现均衡,无明显短板,抽卡失败率低、生成速度快,是较优选择。同时指出选模型需结合需求,国产视频模型有进步,创作故事才刚开始。

进入8月,视频生成模型赛道迎来了集中爆发期,多款新模型接连上线,从Seedance 2.5到Flux 3.0、Minimax H3、Wan 3.0、Sand.ai、Grok Imagine Video等,新品发布的密集程度让人联想到2023年大语言模型的火热夏天,不过这一次的赛道主角换成了视频生成技术。

先来看Seedance 2.5的成片表现,其在光影质感、细节细腻度、人物眼神刻画以及虚实变焦的呼吸感处理上都相当自然,在电影级长片生成、多参考对象控制这类对可控性要求较高的专业场景中,实拍级的画质表现堪称一流。

不过除了Seedance 2.5之外,还有不少模型有着不错的水准且性价比更高。在这个密集发版的阶段,我们来对比几款热门模型的实际表现,找出高性价比的选择。本次测试选取了同价位、720P画质下的三款热门模型:Minimax H3、Seedance 2.0 fast、Wan 3.0,它们都是近期人气和口碑都不错的产品,我们通过统一的提示词和参考图进行了多轮对比测试,从输出质量、生成稳定性、速度以及成本四个维度进行评估。

测试采用统一的标准:使用同一组提示词和参考图,分别让三款模型生成视频,之后对比各项表现。先来看测试的核心结论:Seedance 2.0 fast生成速度快、画质细节出色,实际表现最接近正式版的Seedance 2.0,且抽卡失败率最低;Minimax H3在动效表现上有优势,但在部分高精度场景中容易出现失真问题;Wan 3.0整体表现较为均衡,但缺乏突出的亮点。

人物动作与互动测试

本次测试重点关注人物动作细节、人物间的复杂互动以及是否存在违背物理逻辑的问题。三款模型的表现各有特点:Minimax H3的优势在于画面字体处理和后期能力,面对复杂指令时倾向于保留视觉完整性但较少拓展细节,比如在功夫足球主题的测试片段中,其对运镜精度的理解和场景设计表现一般。Seedance 2.0 fast在人物一致性保持和表现力上最为出色,运镜和人物动作也最符合物理规律,对提示词的理解精准,仅需一次生成就能完整呈现指令要求的全部运镜和画面内容,同时生成速度最快,仅需一分钟即可生成5秒视频,2到3分钟就能生成10秒内容,无需排队等待。Wan 3.0的表现和Minimax H3较为接近,不过动作表现更夸张一些。

剧情动画场景测试

接下来测试带有趣味性剧情的动画视觉短片,比如小猫捞月亮的场景,要求在小猫捞起水中月亮的瞬间,天空变暗、大月亮消失,营造出意外的戏剧效果。Minimax H3的画面饱和度较高、更明亮,但带有小参数模型的伪人感;Seedance 2.0 fast延续了Seedance 2.5的电影叙事光影风格,整体质感出色,但细看会有玻璃细节的小瑕疵;Wan 3.0的完成度不错,但在人物和场景设计上明显逊于前两者。在情节展开、画面逻辑匹配、故事连贯性和戏剧性上,Seedance 2.0 fast的表现明显更好,且该组测试中它的抽卡次数最少,一次生成就达到了较高的完成度。

中式美学场景测试

本次测试的提示词为“一个辉煌悬浮的天宫,中式美学,太空宫殿,辽阔苍茫,有云海有望不到尽头的建筑和无尽的阶梯,仙人居住的地方”。Minimax H3生成的画面更具科幻感,但风格更接近短剧画风,不够唯美;Seedance 2.0 fast依旧表现全能,画质、生成速度、风格保持和延展都很出色;Wan 3.0的生成速度较快,运镜流畅,但画面更像游戏场景,缺乏真实的细节质感。

电影级特效场景测试

本次测试的场景为纽约中央公园霸王龙出没,要求呈现真实的大片质感。三款模型生成的视频基本没有明显的物理穿模问题,但有的更具电影感,有的则偏塑料质感。Minimax H3对恐龙的面部细节、眼神和动作的呈现略显粗糙;Seedance 2.0 fast和Wan 3.0的表现不相上下,都呈现出了不错的大片视觉张力。另外,Seedance 2.0 fast和Minimax H3的三次抽卡结果差异不大,输出都很稳定;而Wan 3.0的不同版本色彩差异稍大,部分版本色彩过于鲜艳,需要根据偏好仔细挑选。

科幻太空场景测试

本次测试选择了月球便利店的场景,宇航员和店员进行交易的剧情,同样进行了三次生成并选取最优结果。由于提示词较为细致,三款模型的镜头语言相似度较高:Minimax H3的色彩饱和度依旧偏高,显得不够真实自然;Seedance 2.0 fast虽然宇航员的表情被头盔遮挡,但人物表现力和真人感都不错,且生成速度一如既往地快,抽卡效率很高;Wan 3.0的运镜表现较为流畅。

动态海报测试

动态海报测试主要关注文字处理和特效细节呈现。横向对比来看,三款模型没有明显的代际差距,不过Wan 3.0的特效场景稍显单薄。

测试总结与选型建议

经过多组测试对比,几款模型都是不会出错的选择,但如果只能选择一款,我会优先考虑Seedance 2.0 fast。这并非因为它的名气最大,而是其风格和质感更符合我的预期,同时如果后续有升级到Seedance 2.5进行精品化创作的需求,Seedance 2.0 fast可以提前输出风格一致的样片,用更低的成本验证效果。对于每天需要产出数十条视频的电商团队、漫剧团队来说,更低的成本、更高的抽卡效率、更少的回炉重造,都能直接转化为实际的利润。

经过这些测试,可以说视频生成模型的六边形战士已经有了明确的方向。Seedance 2.0 fast最接近此前的SOTA模型Seedance 2.0,综合表现最为均衡,没有明显短板,抽卡失败率低且生成速度最快,这或许得益于其和Seedance 2.0、Seedance 2.5同源的数据和训练方式,能够更好地拟合真实世界的多模态数据分布。

另外,在这个模型密集发版的阶段,如果需要将视频生成能力产品化,比如开发特定场景的应用技能来降低成本,部署开源模型也是一个可行的选择,可以针对特定场景进行优化,将成本控制在API服务以下。

选择视频模型没有绝对的最好,只有最适合的。Minimax H3、Wan 3.0同样值得尝试,偶尔也能带来意外的惊喜。从这些模型的表现中,我们能看到国产视频模型的明显进步,也对国内AI技术的发展更有信心。视频生成的下半场才刚刚开始,行业竞争会越来越激烈,模型能力也会持续提升,而对于创作者来说,更有趣的创作故事才刚刚拉开序幕。

以上内容不代表本平台立场,仅供读者参考