【#谷歌史诗级图像模型nano-banana正式发布,OpenAI和Adobe都懵了#】
谷歌刚刚投下了一枚重磅炸弹:正式发布其最先进的图像模型——Gemini 2.5 Flash Image!大家可能对它的另一个名字更熟悉:#nano-banana#。
没错,就是那个前段时间在LMArena盲测中以史上最大分差一骑绝尘,被全球网友票选为「最强图像模型」的神秘选手。现在,它终于揭开了面纱!谷歌CEO劈柴和DeepMind大佬Demis Hassabis都亲自下场“带货”,展示了其惊人的P图能力,随意换装、加配饰,效果堪称“言出法随”,P图师的饭碗这次可能真的危险了。
Gemini 2.5 Flash Image的核心能力主要有四点:
1. 角色一致性:可以在不同场景、风格和姿势中保持同一角色的外观,让个人制作电影的时代又近了一步。
2. 提示词编辑:用自然语言就能实现精细的局部修改,比如模糊背景、去除污渍,甚至给黑白照片上色。
3. 原生世界知识:模型不只懂美学,更懂现实世界。它能像人一样理解和推理,比如预测气球碰到仙人掌会发生什么。
4. 多图像融合:能将多张图片中的元素无缝融合成一张全新的创意构图。
最关键的是价格!每张图片生成成本仅需0.039美元,折合人民币不到3毛钱!这个价格直接对OpenAI等竞争对手形成了降维打击。网友戏称:“谷歌这是请奥特曼吃香蕉呢~”
重点关注:
1、谷歌发布了其顶级图像模型Gemini 2.5 Flash Image(代号nano-banana),该模型在LMArena盲测中以历史性优势夺冠。
2、模型具备四大核心能力:角色一致性、完全基于提示的图像编辑、原生世界知识和多图像融合,极大地提升了图像生成和编辑的控制力与创造力。
3、其价格极具颠覆性,每张图片成本不到3毛钱,对Adobe Photoshop等传统工具和OpenAI等AI竞争对手构成了巨大挑战。
#谷歌AI##图像生成##Gemini##人工智能[超话]##ChatGPT[超话]##AI探索计划#
