歸藏的AI工具箱
25-12-12 16:10 微博认证:AI博主

Runway 急了,昨晚开了一个视频发布会。

直接发布了 5 个新的视频和世界模型:#ai创造营#

首先是它的Gen 4.5视频模型,现在支持原声音频的生成和原声音频的编辑。

ALF 视频编辑模型支持对任意长度和多个镜头的视频进行编辑,保证角色、光照和环境的一致性。

他们发布了自己的首个通用世界模型GWM1,基于Gen 4.5训练的自回归模型,可以根据前序内容进行后续的逐帧预测,用户可以在流式生成过程中随时进行干预及采取行动。

GWM Worlds 实时环境模拟的世界模型,户可以通过描述场景或提供图像参考,生成一个具有正确几何结构、光照和物理属性的沉浸式环境,允许探索和交互。

GWM Avatars 高保真数字人模型,音频驱动的实时视频生成模型,能够模拟自然的人类动作和微表情,既可以模拟逼真的真人,也可以模拟动画角色。

GWM Robotics 机器人与物理 AI 模拟模型,该模型不仅学习成功的交互动态,还能模拟失败场景,这对于机器人学习至关重要,要用于策略评估和合成数据生成

发布于 北京