像素级革命:GPT-Image-2 让 AI 生图进入以假乱真时代
昨天 GPT-Image-2 在灰度测试,可以生成像素级的真实感和颠覆性文本渲染能力,让人很难无法分辨 AI 生成图像与真实图片的差异。
与龙共弈也在竞技场盲测了一下
1、图文排版
时尚杂志内页双栏排版写实画面,超高清 4K,左侧是极简风高级感女性人像写真,右侧是两段完整的英文正文 + 对应中文翻译,主标题为「与龙共弈 OpenAI 的 GPT-Image-2 实测」,副标题为「极简穿搭的核心法则」,正文文字字号层级分明,标点符号完整规范,无乱码、无错字、无笔画缺失,图文间距符合出版级排版规范,纸张带轻微肌理质感,整体为高级莫兰迪色系,比例16:9,2K
可以看到,中文小字部分也表现很好,基本看不出什么乱码,排版也很美观。
2、真实复刻
写实新闻纸质感日报头版,4K 高清,头版通栏大标题为「OpenAI 发布新一代多模态模型 GPT-Image-2」,下方分为三栏完整中文新闻正文,包含导语、事件细节、行业影响等完整内容,左侧配相关新闻图片,图片下方有完整图片说明文字,右上角标注报纸名称、发行日期20260416、版号,所有文字排版规范,标点正确,无乱码、无跳字,1:1 还原真实报纸的排版逻辑,比例16:9,2K
复刻报纸也没什么问题,就像真实的报纸一样,排版到文字,风格几乎和真实报纸一样。
3,软件截图
一个人坐在电脑前,屏幕上清晰显示着一个微信聊天界面,右边是用户消息"帮我做个合同",左边是AI回复"搞定了主人,金蝶软件合同2用户2账套,合计2100元"比例16:9,2K
#
这个相对没那么好,一般人聊微信很少会开全屏吧,聊天记录也没出现其他好友,只有个文件助手,不够真实,如果完善一下提示词,应该也是可以做到的。
神龙摆尾
可惜竞技场出现 GPT-Image-2 的概率很低,抽卡了很多次,才出现几次代号是 duct-tape-2 或者 duct-tape-3 的模型。
结合网友测试的结果,可以发现 GPT-Image-2 是个突破。
文本渲染实现质变,AI 生图的文字乱码问题更少了,可生成精确排版的中英文混排内容,如网页界面、UI设计、解剖图标注,比 Nano Banana Pro 还准的中文小字。
世界知识深度整合,图像细节严格遵循物理常识,比如时钟指针走向正确、多物体光影逻辑合理,解决六指,悬浮物体等失真问题。
真实性跨越,人像生成逼近摄影级质感,皮肤纹理。
看了网友生成的各种截图,是真的真假难辨了,以后判断图片真伪可能要拿个放大镜了。。。
#ChatGPT[超话]##人工智能[超话]##AI创造营##Nano Banana Pro
