AI画图从此不再"等等再等等":OpenAI把生成时间砍半,连草稿都给你秒懂

5次阅读

9月8号凌晨,OpenAI悄悄把ChatGPT里的生图功能整个换了一遍。

新版叫ChatGPT Images 2.5,号称"细节更锐、生成更快、编辑更准、分享更顺"。但最狠的还不是这些参数——是它直接降了一半的延迟。你以前让ChatGPT画一张图要等十几秒,现在同样的活儿五六秒就出来了。

用过ChatGPT生图的都知道,那个"输入提示词→转圈圈→等十几秒→出来的图不是你想要→再写一段提示词→继续等"的循环有多折磨人。延迟砍半,等于把这个循环直接砍半。

而且这次不是只有Plus和Pro会员能玩。免费用户也能用。OpenAI在公告里说得很直白:"Images 2.5今天起在ChatGPT、ChatGPT Work和Codex上向所有等级用户开放,桌面端、移动端、网页端都能用。"

翻译成人话就是——你白嫖也能玩上最新版。

跟上一版比,到底强在哪

先把时间线捋一下。2026年4月,OpenAI刚发了ChatGPT Images 2,那时候的卖点是支持2K分辨率、多比例输出、可以用网络搜索拿到最新信息、懂中文等非拉丁语种,还把Instant和Thinking两种"智商"分开了。

5个月后的2.5版本,按OpenAI自己的话讲,"光照更自然、纹理更细腻,能更稳定地保留参考图里的人脸和物体,多轮编辑指令跟得更准"。

听着像营销话术?别急,这里有具体的提升:

(1) 速度:相比2.0版本,延迟最高降低50%

(2) 细节:人物发丝、皮肤纹理、材质反光更接近真实照片

(3) 参考图一致性:你给ChatGPT一张人脸照片,让它"把这张脸放到东京街头",2.5出来的人物五官跟原图更接近,不会出现"换脸失败"的尴尬

(4) 多轮编辑:你可以先让ChatGPT画一只猫,再追加"换个背景、加副墨镜",2.5能稳定理解这是同一只猫继续改,不像2.0有时候会画一只全新的猫

这四点单独拎出来都不算革命,但加在一起,等于把"AI画图能不能用"这件事从"勉强能玩"推到了"真正可以干活"的临界点。

最让人惊艳的,反而是那个"画板"功能

这次更新里,OpenAI加了一个叫Sketch的小功能。意思是你可以直接在ChatGPT的对话窗口里用手指或者鼠标画几笔——不用画得多好,就是几根线条、一个火柴人、一个色块——然后告诉ChatGPT"按这个改"。

举个例子。你想要一张"在咖啡馆里看书的女人"图,但AI每次画出来的脸型都不满意。这时候你不用反复改提示词,直接在屏幕上几笔勾出你想要的脸型轮廓,ChatGPT就懂了。

这个功能去年各家AI画图工具都在试,OpenAI一直憋到现在才上。说明这事儿没看上去那么简单——让AI理解用户的随手涂鸦,比理解一段精心编写的英文提示词难多了。

还有一个细节:OpenAI现在支持"提示词分享"了。你调出了一个特别满意的提示词,可以直接生成一个链接扔给朋友,他点开就能用一模一样的设置重画。这事儿在小红书和抖音上估计很快就要火起来。

开发者那边,出了两个新模型

普通用户用ChatGPT就行了,但如果你在用API自己接AI生图——比如做电商海报、做小红书封面图、做APP里的头像生成——这次OpenAI放了两个新模型:

(1) GPT-Image-2.5 Flare:默认推荐款。比上一代质量更高、编辑更强、延迟更低50%,适合大部分日常应用场景——电商图、社交媒体配图、营销素材。

(2) GPT-Image-2.5 Sunburst:高端创意款。专门给"需要精细控制每一帧细节"的场景准备的,比如广告大片、产品图精修、影视前期概念图。

两个模型分工明确:一个打天下,一个冲高端。这是OpenAI把生图功能往"专业生产工具"方向推的明显信号。

不过有个坏消息:根据业内报道,2.5的API定价相比2.0翻了一倍。这意味着如果你是个重度用户,每个月跑图的账单可能要多出一截。

但这事儿看你怎么想。生图这事儿的边际成本以前是"AI算力+电费",现在变成了"AI算力+电费+OpenAI利润"。对企业用户来说,过去那种"反正便宜随便用"的心态得改改了——不然月底账单会让你怀疑人生。

普通人能用它干什么?

说回普通人。你可能会问:"我不是设计师,也不是电商运营,这玩意儿对我有啥用?"

真用起来,比你想的多。

(1) 朋友圈/小红书配图:你写了一段游记,让ChatGPT配几张风格统一的图。以前得用Midjourney或者国产AI,折腾账号折腾登录。现在直接在ChatGPT对话框里说"北京胡同秋天的黄昏,写实摄影风格",5秒出图。

(2) 头像/壁纸:拍一张自己的照片,让AI生成"在巴黎铁塔下""在故宫红墙前""在海滩日落里"的不同版本头像。以前这种服务要花钱找人P,现在AI免费给你做一打。

(3) 给孩子做绘本:你写一段睡前故事,让AI"每页一张插图,绘本风格,主角是只蓝色小猫"。一个晚上做出一本独一无二的睡前故事书,比买的玩具还让孩子爱不释手。

(4) 装修/服装/发型预览:装修前"未来客厅的样子",理发前"我换个发型会怎样",买衣服前"这件穿在我身上效果"。以前得用专业软件,现在一句话的事。

(5) 工作汇报配图:周报PPT里要放几张示意图,以前是去图库搜,现在让AI按你的内容生成专属配图,不用担心版权问题。

(6) 写公众号/短视频脚本:让AI按你的脚本生成对应的封面图、情节图、转场图,整个流程一气呵成。

看明白了吧?ChatGPT Images 2.5这种工具,真正改变的不是设计师的工作流,是普通人的"表达门槛"。你脑子里有个画面,以前表达不出来就算了,现在能画出来。

Google的反击也来了

OpenAI这边刚把生图功能升级完,Google那边也没闲着。就在这周前后,Google把Gemini的Nano Banana 2生图模型也升了一档。

外媒已经在对比测试了——两个模型在人物面部、宠物毛发、局部细节保留这些维度上互有胜负。简单说,OpenAI强在"听懂你的修改意见",Google强在"一次性生成的质量"。

对普通用户来说这是好事。巨头打架,用户得利。以前生图是OpenAI的强项,现在Google追上来一半,价格战就快要打起来了。等到那一天,"免费生图"的边界会更宽。

但别高兴太早,AI生图还有三个雷区

工具是强了,但风险也跟着大。

(1) 版权问题:AI生成的图片到底归谁?目前法律还在模糊地带。但OpenAI的用户协议里一般会留一手——你用ChatGPT生图,版权归你,但OpenAI保留使用权。这意味着你做的图理论上可以被OpenAI拿去训练下一代模型。

(2) 假图泛滥:现在AI生成的图已经能骗过肉眼。下一步就是新闻配图、社交媒体爆料图——以后看到任何一张照片,第一反应都该是"这是不是AI生成的"。

(3) 隐私泄露:你上传自己或者朋友的脸去生图,这些照片就进了OpenAI的服务器。虽然有隐私政策约束,但真出了事,你很难证明"AI滥用了我家娃的照片"。

所以工具越强,越要清醒。AI生图是个好工具,但它也是一面镜子——照出来的不只是你想要的画面,还有这个时代的真实模样。

写在最后

5个月前ChatGPT Images 2出来的时候,很多人还在问"AI画图真的能干活吗?"现在2.5版本出来了,答案变成了"可以,而且越来越快"。

从"画一张图等十几秒"到"等五六秒",这不只是数字变化。是一整代人的创作门槛,又被悄悄削掉了一截。

你可能不需要靠画画吃饭,但你一定会有需要把脑子里画面拿出来的那一刻。到那时候,你会发现ChatGPT就在那儿等着,5秒钟之后,就能给你一个比你想的还像样的答案。

工具永远在进化。唯一的问题是——你什么时候愿意亲手按下那个按钮。

正文完
 0