我承认Anthropic和Google都很强,但是今天,OpenAI要更胜一筹。
一夜之间,AI做图以假乱真的能力,可能要提高1000倍了。
让乔布斯代言小米SU7,海报它能直接安排上。
让奥特曼直播卖课,截图也直接以假乱真。
让它生成非主流的QQ空间截图,它连BGM和歌手都一一对应准确。
甚至还能直接做出库克官宣卸任苹果CEO、宣布由老罗来接任的微博截图。底下还自动拉来了王自如的评论。
这就是OpenAI刚发布的新图像模型GPT-image-2。
上面看到的那些离谱图片,都是用它直接搓出来的。毫不夸张地说,AI做图的能力,从来没有如此强过。
在大模型竞技场里,当大家的平均分都在1200分左右厮杀的时候,GPT-image-2直接给干到了1500分,遥遥领先其他模型。
而且这玩意还不是个期货。可能是Sora被关闭之后,OpenAI的算力变得更多了,所以山姆·奥特曼也是大放善心——现在不管你是免费用户还是付费用户,都可以在ChatGPT的官网里直接用上。就连API也是直接开放,不但量大管饱,而且价格还只要Nano Banana Pro的四分之一。
一张参考图,穿越到任何世界
我们也帮大家简单试了一下。
只要你上传一张参考图片,它就可以精准还原你的形象。有了它,你可以随意穿越到任何游戏里,或者是和任何角色合影。
比如让它生成"这个角色和原神里的旅行者(女)、绝区零里的铃、崩坏星穹铁道里的星这三个角色的合影,背景是无垠的宇宙"——效果直接拉满。
你也可以用它来生成各种奇奇怪怪的图像:原神和塞尔达的联名海报,宝可梦和幻兽帕鲁的联动新闻,甚至就连"火锅(眼睛健康版)在白宫散步"的照片也能一键生成。
自带知识储备,堪称AI界的懂王
新模型还有着非常丰富的知识储备,堪称AI界的懂王。
即使你问到了它不懂的东西,GPT-image-2也会直接开始思考,现查现学。
比如我直接给它出了一道一元二次方程的题,要求给个教材的截图。它是真的带脑子,直接一步步推导出了答案。经常上学的网友也可以验算看看,答案对不对。
与此同时,GPT-image-2还能生成非常稳定、高质量的中文文本,在它给出的图像里,文字出现崩坏的概率小了很多。
让它做个西湖醋鱼的制作流程也能一次完成,效果要比Nano Banana Pro不知道高到哪里去了。
一句话出图,门槛被打下来了
差评君用下来感觉最重要的是——这次的GPT-image-2模型审美非常好。
你不用费太多力气写一大堆提示词,它就能给你出一张90分的图片。像是红白机的宣传海报、抖音女主播带货截图,甚至今天在前面看到的绝大多数案例,都是只要用了一句话或者几句话的描述就能做出来的。
你还能发现,在生成抖音截图里,AI观众还会在弹幕里实时交流,给咱们开演一波小剧场。
这也是它相比过去模型所不同的地方。
过去你想让AI做一张抖音截图,你可能得告诉它这张图的最上面是什么、最右边得放什么、下面放什么——写一大长串提示词:
整个画面必须像真实手机截图,而不是设计图。需要完整呈现短视频直播UI叠层:顶部有状态栏,显示时间、电量、信号、Wi-Fi;左上角有主播头像、用户名、直播中标识、实时在线人数;右侧有一排直播交互按钮,比如点赞、评论、分享、礼物、关注;底部有半透明评论区,观众弹幕不断刷过,内容是中文,口语化、简短、像真实直播弹幕;右下角有礼物特效入口、购物袋入口或者更多功能按钮;底部输入栏有"说点什么…"之类的互动区域;直播界面中有平台风格的红色或高亮直播标识;整体布局必须符合真实中国直播平台的移动端视觉习惯。
但现在,只要简单说一句话,AI就会自动搞懂你的意思。搞不懂的地方,它还会自己去查。
和年初的Seedance 2.0一样,用好AI的门槛再一次被狠狠地打下来了。
有图有真相的时代,算是彻底和我们切割了。
新模型做出来的很多图像,不但能够轻松骗过我们的眼睛,就连专门的AI图像检测助手也是直接睁眼瞎。
今天编辑部的小伙伴玩了一天之后,直接被这个模型以假乱真的能力给搞到破防,直接发出"我们这辈完蛋了"的感慨。大家在群里看到的每一张图,都要思考这玩意是不是AI做的。
美中不足:Gemini的水印和失去灵魂的书法
不过,虽然现在的新模型能力已经很强了,但在高强度的试用后,我们还是发现了一些缺点——哦不,美中不足的地方。
最让我绷不住的是,我们在一些图片右下角,隐隐约约地发现了Gemini的水印。不知道是不是蒸馏过Nano Banana的数据,或者说网上的图片数据已经被Nano Banana给污染霍霍完了,导致新模型被这些有毒数据污染了。
同时,我们还发现这次的GPT-image-2虽然生成的汉字很稳,但同时这些字也失去了灵魂。
如果我们直接让它生成一幅书法真迹,你会发现它做的好像还挺有模有样的。可一旦你让它把这幅书法字帖里的字给换掉,大家就会发现,它做出来的字印刷感还是蛮重的,完全不是手写的风格。
再包括很多文字,在放大细看的情况下,还是有一丝微崩。也期待友商或者下个版本能彻底堵上这些Bug吧。
AI圈真的像是有一种轮回
先是OpenAI一骑绝尘,之后谷歌逆袭,再来个Anthropic砸场,还有个随时可能掀桌的DeepSeek。而现在,我们的位置又来到了这里。
另外再友情提醒一下:从GPT-image-1爆火、全网刷屏吉卜力头像,到Nano Banana魔性出圈、网络上被AI生成图疯狂刷屏,再到如今Image-2直接降维打击,前后其实才一年多。
已经不敢想,明年的这个时候,AI会进化成啥样了。