欧巴聊AI
26-08-01 20:43 微博认证:AI博主

众所周知,AI 视频模型的老大哥是 Seedance。

一直是一骑绝尘,无人能敌的存在。

但最近 MiniMax H3 发布,这个赛道就变得有意思了。

在 LibTV 上 H3 又是全网首发,在活动期间 768p 分辨率才一毛钱一秒,2K 分辨率也才两毛,不到 Seedance 2.0 的一半。

H3 的能力本身就很能打,成本又降了下来,量变就会引发质变。

更关键的是,H3 会在未来几天内开源。

过去这两年,大语言模型开源已经成为了常态,一家接着一家,但视频这边能打的几个都是闭源。

视频模型的开源,这绝对是里程碑级别的存在。

话不多说,咱们直接在 LibTV 上,边测边聊。

# 实测

先来看下 H3 的关键参数,H3 支持 5 到 15 秒生成,24 FPS 输出,原生双声道。

21:0,16:9,4:3,1:1,3:4,9:16 这些主流画幅全覆盖。

单次最多输出 9 张图片,3 段视频,3 段音频,混合参考素材总数上限 12 个文件,提示词支持到 7000 字符。

第一个实测,我用 H3 和 Seedance 2.0 做了一组对比。

直接把难度拉满,用同样的提示词和图片素材,让他们生成游戏 UI 动效。

输入是 3 张图片,包括角色图,UI 图和完整游戏界面图。

结果我是真没想到,H3 的表现甚至盖过了 Seedance 2.0。

这个是 H3 的效果。

这个是 Seedance 2.0 的效果。

结果明显是 H3 更好,UI 面板的滑入滑出很干净,菜单文字没有糊,装备切换的顺序很丝滑,最后环境加载那一段的空间关系也是对的。

Seedance 2.0 这边反而出现了 Bug,切换装备时多出了一条手臂。

积分花费上分别是 198 和 405,在这个实测的表现上,H3 明显超过了 Seedance 2.0。

第二个,我想实测下最近很火的玩法。

将 2D 卡通形象和 3D 场景的融合,素材很简单,输入的图片是猫咪的表情包和一张桌面背景图。

值得一提的是,LibTV 里可以很方便的同时抽 4 张卡,甚至 8 张卡。

主打一个效率拉满。

最后,我选了一个综合效果最好的。

不得不说,H3 的表现依旧稳定,这里面的声音也都是模型直出的。

画面和声音是推理完一块产出的,它知道这一帧画面里需要对应什么声音。

你不用生成完画面再去自行配音,也不用担心动作和音效会错位。

做短剧的团队应该最懂这个价值,因为玩 AI 视频有时候还是需要抽卡的,抽卡本来就是概率游戏。

以前你是一次一次抽,现在在 LibTV 里,你可以一次开四张牌再挑那张最好的。

第三个,我测试的是爆款视频复刻。

为了增加难度,还是真人出镜的多人场景。

输入的素材有两张人物图,一张背景图,和一个初始视频。

提示词很简单,让人物动作,表情和表演节奏严格参考初始视频,再分别明确人物和场景的对应。

最后的效果是这样的。

这个效果真的有点离谱了,H3 要比想象中还要猛。

表演节奏,人物动作,光影氛围,甚至视频特效,都迁移得非常精准,几乎挑不出任何毛病。

输入的人物和环境的一致性,也是拉满的。

更重要的是,这是一次直出的效果,我完全没有抽卡。

第四个,咱们继续上难度。

让它来一条一镜到底,中间频繁的切换画风。

考验它长时间的连续性,和画面内部的剧烈变化,输入的素材只有一张人物图。

直接来看效果。

看到最后产出的效果,我还是觉得非常惊喜的。

看来很难难倒 H3 了,我写了 800 多字的提示词,它的指令遵循还是非常好的。

无论是场景切换,镜头切换,还是频繁的画风切换,都非常丝滑。

说明它确实能理解非常复杂的提示词,并且还能知道在同一个空间里,如何优雅丝滑的过渡。

最后,必须来夸一夸 LibTV 的一整套极致的画布体验。

各种参考素材和输入输出的连线,图片和视频节点关系,整条链路一眼全部看得清清楚楚。

想要换个参考,改一下节点重新跑就行,其他的内容完全不受干扰。

再加上咱们之前讲过的 Agent 和各种专家级的 Skill。

坦率地说,LibTV 绝对是我心目中创作领域的最佳产品了。

# 尾声

Seedance 2.0 发布之后的大半年,AI 视频这个赛道其实挺安静的。

MiniMax H3 出来之后,这回就变得热闹和有趣了。

但我更想说的,不是谁打败了谁。

真正的变化是,当一条视频的成本打下来之后,创作这件事的性质就会改变。

之前很多舍不得尝试的想法,现在可以毫无顾忌的玩起来。

再加上模型开源,就是想把能力交到更多人手里,这就是技术真正的善意。

写到这里,我还是会想起第四条片子里,那把小钥匙在手里长成剑的一瞬间。

当时看到后,我愣了一下。

就像以前你只是脑海里有一个念头,但现在它能被你的手握住了。

#how i ai##科技先锋官#

发布于 北京