图像中近乎完美的文本渲染、逼真的 UI 截图,以及照片级真实感的显著提升。当用户被要求输入包含文字、符号、标签、用户界面元素或代码片段的图像时,看似 GPT Image 2 的结果明显比之前的模型更准确。字符格式正确,间距一致,较长的字符串也保持连贯性。