OpenAI正式推出GPT-Images-2.5图像生成系统,在生成速度、编辑精度和交互方式上实现多项突破。该系统面向ChatGPT、ChatGPT Work及Codex全平台用户开放,免费版用户亦可体验核心功能。据官方披露,目前每周通过ChatGPT Images与GPT-Image API生成的图片总量已突破30亿张,日均处理量约4.3亿张。
在性能优化方面,新系统生成延迟较前代最高降低50%,同时显著提升照片与纹理的渲染质量。针对用户长期反馈的"局部编辑牵连全局"问题,GPT-Images-2.5引入精准区域编辑技术,可保持画面其他元素的构图、光照和主体特征。通过类似Figma设计工具的标注系统,用户可直接在图片上圈定修改区域,实现更直观的操作交互。
多轮编辑稳定性是另一重要改进。系统在连续修改过程中能完整保留前期编辑成果,避免画质随操作次数增加而衰减。Higgsfield AI产品负责人指出,该技术突破在于精准理解"不应修改"的内容边界,确保角色、构图和视觉风格在编辑过程中始终如一。
交互方式革新方面,新系统推出Sketch手绘输入功能。用户通过对话框输入@Sketch即可激活手绘面板,绘制草图并附加文字描述后,系统将以草图为构图参考生成成品图像。官方演示显示,该功能可将房间布局草图转化为室内设计渲染图,或将人物轮廓转化为专业插画。配套推出的模板库覆盖海报、商品图等高频场景,用户选择模板后填充信息即可自动生成符合预设结构的图像。
针对开发者群体,OpenAI在API端首次推出快慢双模型架构。定位高频场景的GPT-Image-2.5 Flare模型,在社交内容生成、产品原型设计等场景中展现出2-4倍的出图速度优势,其透明背景生成功能对品牌素材制作具有实用价值。面向高端创意需求的Sunburst模型则通过延长生成时间换取更精细的编辑控制,适用于品牌营销素材和精修产品图制作。Adobe已确认在Firefly平台接入该技术,强调新版本在多轮精修后仍能保持图像清晰度与真实感。
此次升级标志着图像模型迭代进入新阶段。通过将速度与质量分层的产品策略,OpenAI为不同场景提供差异化解决方案:Flare模型满足高频低延迟需求,Sunburst模型保障高精度定制效果。这种架构设计延续了语言模型API的分档逻辑,反映出多模态技术正在向专业化、场景化方向深化发展。值得注意的是,图像生成能力的提升与Computer-Use等基座模型能力形成协同效应,可能成为OpenAI应对行业竞争的关键技术布局。
