英伟达发布3D 场景生成模型--Lyra 2.0
英伟达发布一个能够继续让显卡涨价的模型---Lyra 2.0
这个模型用于场景化3D视频生成
NVIDIA 刚端出了 Lyra 2.0 。不再单纯卷几十秒的“赛博废片”,而是开始解决视频模型生成 3D 空间时的底层逻辑 Bug。
▪️ 空间遗忘 (Spatial Forgetting):抛弃了纯像素依赖,通过维护每一帧的 3D 几何数据来做信息路由。简单来说,就是用点云锁死历史视角的空间坐标,解决模型“回头看就出现幻觉”的毛病。
▪️ 时间漂移 (Temporal Drifting):引入了自增强训练 (Self-augmented training),让模型自己纠正自回归过程中不断放大的几何形变误差。
给一张图,直接吐出一个能放机器人进去跑仿真的 3D 空间。
🔗 论文:
http://t.cn/AXM1NGV7
🔗 项目页:
http://t.cn/AXM1NGVh
发布于 四川
