ChatGPT Image 2.5 生成的蒸汽朋克风钟楼测试图

OpenAI新一代图像生成模型“ChatGPT Image 2.5”已补上前代饱受诟病的过度锐化短板,但与“Nano Banana 2”的正面对比中,双方仍难分伯仲。最新测评显示,在6项评估指标中,两款模型各胜3项,整体表现基本持平。

据区块链媒体Decrypt于9月12日报道,这轮对比测试显示,ChatGPT Image 2.5在复杂场景的空间构图、氛围塑造以及插画类任务上更占优势;“Nano Banana 2”则在图像中的文字呈现、日期和年份等可验证细节的处理上更稳定。

OpenAI于9月8日发布ChatGPT Image 2.5时表示,新模型在细节清晰度、纹理丰富度、光照自然度以及图像编辑精度方面均有所提升。在图像修改环节,模型保留用户明确要求“不要改动”元素的能力也进一步增强。OpenAI同时称,与Image 2.0相比,新版生成延迟最多可降低50%。

API方面,OpenAI新增两款模型:“GPT-Image-2.5 Flare”和“GPT-Image-2.5 Sunburst”。其中,Flare主打基础型高速出图,Sunburst则定位更高,侧重精细化图像编辑。

此次测评是对今年5月一轮对比评估的延续。当时,OpenAI旧版模型在处理包含多重限制条件的提示词时,被指出存在画面过于锐利、观感失真的问题。

从本轮结果看,这一缺陷已明显缓解。在蒸汽朋克场景和人物肖像等测试中,ChatGPT Image 2.5未再出现明显偏黄或重度后期处理感,复杂画面的稳定性也有所提升。

不过,在细节准确性上,“Nano Banana 2”仍占上风。以包含大量文字的城市十字路口场景为例,“Nano Banana 2”能够较清晰地还原大部分文案内容。

相比之下,ChatGPT Image 2.5在“KELLERMAN'S”一词中的撇号出现缺失或难以辨认的情况,街头艺术字样也有部分拼写错误。尽管整体写实感更强,但在图像文字的准确性上,仍不及“Nano Banana 2”。

在空间构图与氛围表达方面,ChatGPT Image 2.5则展现出明显优势。在钟楼主题测试中,其对蒸汽、河流和透视关系带来的色调变化处理更自然,画面层次和立体感也更突出。

Decrypt指出,ChatGPT Image 2.5整体上更能遵循提示词要求,同时保持较强真实感。“Nano Banana 2”虽然将罗马数字处理得更易读,但钟表指针所对应的时间与提示词并不完全一致。

在插画风格更强的场景中,ChatGPT Image 2.5同样获得更高评价。以动画风格的“灵性变身”画面为例,其天空表现和整体视觉完成度更高。不过,在执行细节指令时,该模型仍存在偏向“意译”而非“直译”的问题。对于“人物融化成能量”的要求,它更倾向于通过人物发丝周围的电流特效来诠释。相比之下,“Nano Banana 2”更接近字面还原,但整体完成度略逊一筹。

在更偏写实的人像任务中,两款模型的优劣分化也较为明显。在“屋顶上的建筑师”这一测试题中,ChatGPT Image 2.5在光线和皮肤质感表现上更出色,但也出现了皮肤过度平滑的问题。

“Nano Banana 2”虽未能准确摆放蓝图位置,但在整体构图以及文件标签呈现上相对更稳。测评还指出,若只看单次生成结果,“Nano Banana 2”的竞争力更强;若纳入反复修改、持续迭代的工作流,ChatGPT Image 2.5的优势则更加明显。

双方差异最明显的环节,出现在需要事实核验的信息图任务上。两款模型都支持先检索资料再生成图像,但在比特币时间线信息图测试中,ChatGPT Image 2.5将关键年份标错:其将美国比特币现货ETF获批时间写成2023年,而美国首只比特币现货ETF的实际获批日期为2024年1月10日。

“Nano Banana 2”生成的信息图结构也并非完全工整,但其将比特币现货ETF获批和第四次减半归纳为2023年至2024年这一时间区间,从而避开了更明确的事实性错误。

测试认为,这类“看似自信却出错”的日期标注,问题甚至比单纯的设计缺陷更严重。这也再次说明,在生成事实类内容时,生成式AI的评判标准不仅在于画面清晰度和设计效果,信息准确性同样关键。

而在抽象概念或无实际含义造词的可视化任务中,ChatGPT Image 2.5则更具优势。该模型会直接将未被定义的词汇渲染为招牌或桌游盒上的可读文字。Decrypt认为,这种把“未定义概念”转化为可识别视觉元素的能力,是其强项之一。“Nano Banana 2”虽然营造出更温暖、文化感更强的画面氛围,但未能在图像中明确呈现提示词中的造词。

除模型本身外,OpenAI此次还同步强化了相关配套功能,包括允许用户在ChatGPT内直接绘制粗略构图草图、分享提示词,以及对图像特定区域添加行内评论;同时还提供适用于海报、商品制作等场景的分格式模板。API端的画质档位也进一步扩展,在原有基础上新增“high”和“max”两个等级。

整体来看,这场对决基本势均力敌。ChatGPT Image 2.5修复了前代最具代表性的缺陷,并在部分场景中交出了更惊艳的成品;“Nano Banana 2”则在拼写、年份、标注等可被直接验证的细节上表现得更稳。测评认为,双方差距不在整体画质,而更多体现在文本误写、年份标错等细节层面的准确性上。

关键词

#OpenAI #ChatGPT Image 2.5 #Nano Banana 2 #AI图像生成 #图像编辑 #文字呈现 #年份标注 #GPT-Image-2.5 Flare #GPT-Image-2.5 Sunburst
版权所有 © DigitalToday。未经授权禁止转载或传播。