这个月,字节和阿里都发布了自家最强大的图片模型,分别是Seedream 5.0 Pro和Qwen-Image-3.0,加上目前为止公认的SOTA级图片模型GPT-Image-2,我用同样的提示词来做几轮测试,你们可以对比评价一下优劣。
3张图片为1组,顺序都是Seedream 5.0 Pro、Qwen-Image-3.0、GPT-Image-2:
第1组 - 夜晚站台的清冷人像,主测光影效果、人体结构和肖像美学;
第2组 - 90年代胶片动画风格的来生泪截图,主测风格和角色的还原度;
第3组 - 给汽水音乐设计一张广告海报,主测平面设计、字体排版以及指令遵循程度;
第4组 - 用手机拍摄电脑屏幕上的视频聊天窗口,主测真实感、不出错和画中画效果;
第5组 - 游戏引擎的2B建模局部放大,主测精细度和画面质感;
第6组 - 订书机与眼镜蛇的融合,主测创意实现和超现实主义意图理解。
发布于 湖北
