ITBEAR科技资讯
网站首页 科技资讯 财经资讯 分享好友

GPT-Image-2.5重磅登场:生成加速、编辑精准,开启AI图像创作新纪元

时间:2026-09-09 07:58:49来源:快讯编辑:快讯

OpenAI 正式推出 GPT-Images-2.5,在图像生成速度、编辑精度和交互方式上实现多项突破。该版本将生成延迟最高降低50%,并首次在API层面推出快慢双模型架构,同时支持手绘草图直接生成图像,标志着AI图像生成技术进入更精细化的控制阶段。

在核心性能方面,新版本显著提升了图像生成效率。官方数据显示,相较于2.0版本,生成延迟最多减少50%,且在保持人物主体还原度的同时,优化了光照和纹理渲染质量。针对长期困扰用户的局部编辑问题,系统现在能够精准识别修改区域,在复杂背景或多主体场景中保持构图稳定性,避免对未指定部分的无意改动。用户可通过类似设计工具的标注功能,直接在图像上圈选修改范围,操作逻辑与Figma等设计软件高度相似。

交互方式革新是本次升级的另一亮点。用户现在可以通过输入"@Sketch"调用手绘面板,用简单草图搭配文字描述生成专业图像。示例显示,房间布局草图可转化为室内设计效果图,人物轮廓能快速生成风格化插画。该功能降低了创作门槛,用户无需具备专业绘画技能,只需通过空间关系和比例的粗略描绘即可传达创作意图。系统内置了海报、商品图等常用模板,用户填写信息后即可自动生成符合结构要求的图像,省去反复调试提示词的步骤。

API服务首次实现分层架构,推出Flare和Sunburst两款独立模型。Flare主打高速批量生成,适用于社交媒体内容、产品原型等需要高频出图的场景,实测显示其速度达到前代模型的2-4倍,特别在透明背景生成方面有显著改进。Sunburst则面向高端创意工作流,通过延长生成时间换取更精细的编辑控制,适用于品牌营销素材和精修产品图等需要高精度输出的场景。这种分层设计使开发者可根据业务需求选择合适模型,避免为用不上的精度支付额外等待时间。

多轮编辑一致性得到实质性提升。在长对话场景中反复修改同一张图片时,系统能够完整保留前期编辑结果,避免画质随修改次数增加而下降。这一改进解决了生图工具长期存在的"记忆衰减"问题,使复杂创意项目的迭代过程更加流畅。Prompt分享功能则构建了创意社区生态,用户可将成功案例的完整提示词公开发布,他人通过替换个人照片和细节即可生成相似风格作品,目前"80年代复古肖像"等提示词已在社交平台广泛传播。

行业合作方面,Adobe确认在Firefly中接入新模型,利用其速度优势提升品牌素材和演示文稿的生成效率。技术评测显示,经过多轮精修的图像仍能保持清晰度和真实感,分辨率稳定性显著增强。OpenAI通过架构优化实现性能跃升,其迭代节奏已与语言模型保持同步,2024年发布的1.5版本同样采用"速度先行"策略,显示公司在多模态领域的持续投入。

更多热门内容
宇树科技再突破:世界模型驱动人形机器人首秀全自主搏击新技能
宇树科技表示,该模型突破了世界-动作大模型在瞬时规划、决策和动态交互执行等方面的瓶颈,实现了高动态、强交互以及对未来的实时预测和规划。 王兴兴此前曾多次提出一个具身智能的“ChatGPT时刻”标准:如果在80…

2026-09-09

AI智能体评估难题如何破?Rapidflare框架提供高效解决方案
评估这类系统并非易事,因为需要判断答案是否事实正确、是否基于正确的信息来源、对用户是否有用,以及在模型、提示词和底层数据不断变化的情况下是否依然可靠。 A:借助该框架,Rapidflare在约一个月内评估并…

2026-09-09

宇树科技UnifoLM-X2-1.0:全自主机器人格斗开启具身智能新篇章
UnifoLM-X2-1.0的核心进展在于突破了世界-动作大模型在瞬时规划、决策输出和动态交互执行三个方面的技术瓶颈。在高动态、强对抗的格斗场景中,机器人能够持续感知对手位姿与接触力,在模型内部实时预测下一…

2026-09-09

让机器人学会“手感”:TacForcing让精细操作告别“闭眼”困境
如果让当前这一刻采集到的触觉信息去指导三四个块之后才会执行的动作,那等真正执行到那一步时,手指的接触状态早就变了,你现在这份触觉快照早就过期作废了,指导意义反而可能是负的。这个任务需要机器人用滴管精确控制吸取…

2026-09-09

对话芝诺机器人植伟铭:探索协作物理智能,让机器人“学会一起做事”
更重要的是,我们把 collaboration 本身作为一个 data-driven learningproblem(数据驱动的学习问题)——不是通过显式 planning、scheduling 或预设通信…

2026-09-09