昨晚,Google DeepMind悄悄放出了两个大招。
第一个叫Nano Banana 2 Lite,技术代号gemini-3.1-flash-lite-image。这东西可能是目前市面上最快、最便宜的文生图模型了。4秒出一张图,分辨率1K高清,单张成本低到0.24元。速度和价格都卷到了一个新的量级。
第二个是Gemini Omni Flash,定位是面向开发者的高质量视频生成模型。它支持图片、文字、视频混合输入,带来了一种全新的体验:对话式视频编辑。你可以像聊天一样告诉它你想怎么改视频,它就帮你改。
但说实话,这两个模型单独拿出来,虽然各自都很能打,但还不算谷歌这次真正的杀招。
真正厉害的地方,是谷歌通过Interactions API把这两个模型串起来了。
怎么串的呢?Lite负责高速生图,Omni Flash负责把静态图动画化,变成视频。配合Interactions API,最多可以连续叠加三次编辑,一步步精修。
这样一来,一条完整的创作流水线就被打通了:文字生成图片,图片生成视频,中间还能反复调整。
从文字到图片到视频,整个链路一气呵成。谷歌这次做的事情,本质上是把AI创作从单点工具变成了一条流水线。每个环节都够快、够便宜、够灵活,串在一起之后,创作门槛又被拉低了一大截。
#科技先锋官# #How I AI#
发布于 山东
