正在阅读:

OpenAI推出最强AI图像生成模型,延迟减少50%

扫一扫下载界面新闻APP

OpenAI推出最强AI图像生成模型,延迟减少50%

ChatGPT Images 2.5,在生成速度、画面细节、局部编辑稳定性上完成多项核心升级。

OpenAI;AI图像生成模型;最强;延迟减少;50%;SEO;爬虫

图片来源:界面图库 匡达

当地时间9月8日,OpenAI推出图像生成模型ChatGPT Images 2.5,在生成速度、画面细节、局部编辑稳定性上完成多项核心升级,同步上线手绘草图生成、图片定点修改等交互功能。

相比上一代ChatGPT Images 2.0,新版本最直观的变化是生成时延降低,官方数据显示图像生成延迟最高可减少50%,大幅缩短用户等待图片输出的时间。

除速度优化外,模型在画面细节、光影材质还原能力上得到强化,重点解决旧版本多轮编辑容易出现主体变形、构图崩坏的痛点。当用户对图片进行局部修改指令时,模型可以精准锁定需要调整的区域,保留原图人物主体、产品外形、画面构图与整体风格,大幅降低创作者反复调试提示词的成本。

产品端配套新增多项创作工具,其中Sketch手绘功能是本次更新的亮点,用户不需要具备专业绘画功底,仅勾勒基础构图就能快速把构思转化为成品图。

ChatGPT Images 2.5现已面向所有ChatGPT、ChatGPT Work和Codex用户开放,支持桌面端、移动端和网页端。

此外,GPT-Image-2.5 Sunburst和GPT-Image-2.5 Flare模型已通过API提供。Flare作为通用版本,具有2.5系列速度、画质与编辑能力,适合社交媒体素材、产品原型、大批量图像生成场景;Sunburst主打高精度精细编辑,面向广告大片、商业产品图等专业生产级视觉内容,图像可控性更强,但生成耗时更长。

在AI图像生成赛道,ChatGPT Images 2.5的核心差异化优势在于深度嵌入对话交互链路。当前市场中,Midjourney在艺术质感、电影感画面输出上仍保持优势,但产品缺少原生对话交互与草图输入能力,上手门槛更高;Adobe Firefly 依托创意软件生态,在商用版权保障方面更有竞争力,但独立对话创作能力偏弱;谷歌 Gemini 内置图像模型在品牌一致性控制上仍存在短板。

据OpenAI 披露,ChatGPT Images系列模型及对应API每周图像产出总量超过 30 亿张。

本次图像模型更新,是OpenAI近期密集产品迭代之一。就在9月3日,公司发布旗舰大模型 GPT-6 Astra,强化自主计算机操作、复杂推理、编程与科研任务处理能力,支持直接识别屏幕像素并模拟键鼠操作,可直接操作各类软件界面,被视作其推进智能体能力的重要一步。

OpenAI 联合创始人兼总裁格雷格・布罗克曼在发布电话会议上表示,“欢迎来到AGI时代”。

9月7日,黄仁勋在社交平台发文称,OpenAI从发布ChatGPT到o1再到Astra只用了4年。“AGI已经到来,恭喜OpenAI团队。”

不过,9月6日,OpenAI首席科学家雅各布・帕乔基(Jakub Pachocki)在官网发布万字长文,称人类已经创造出一套难以完整理解的智能体系,全人类尚未做好应对超级智能快速演进的准备,呼吁全球AI研发主动放缓全速扩张节奏。

未经正式授权严禁转载本文,侵权必究。

评论

暂无评论哦,快来评价一下吧!

下载界面新闻

微信公众号

微博

OpenAI推出最强AI图像生成模型,延迟减少50%

ChatGPT Images 2.5,在生成速度、画面细节、局部编辑稳定性上完成多项核心升级。

OpenAI;AI图像生成模型;最强;延迟减少;50%;SEO;爬虫

图片来源:界面图库 匡达

当地时间9月8日,OpenAI推出图像生成模型ChatGPT Images 2.5,在生成速度、画面细节、局部编辑稳定性上完成多项核心升级,同步上线手绘草图生成、图片定点修改等交互功能。

相比上一代ChatGPT Images 2.0,新版本最直观的变化是生成时延降低,官方数据显示图像生成延迟最高可减少50%,大幅缩短用户等待图片输出的时间。

除速度优化外,模型在画面细节、光影材质还原能力上得到强化,重点解决旧版本多轮编辑容易出现主体变形、构图崩坏的痛点。当用户对图片进行局部修改指令时,模型可以精准锁定需要调整的区域,保留原图人物主体、产品外形、画面构图与整体风格,大幅降低创作者反复调试提示词的成本。

产品端配套新增多项创作工具,其中Sketch手绘功能是本次更新的亮点,用户不需要具备专业绘画功底,仅勾勒基础构图就能快速把构思转化为成品图。

ChatGPT Images 2.5现已面向所有ChatGPT、ChatGPT Work和Codex用户开放,支持桌面端、移动端和网页端。

此外,GPT-Image-2.5 Sunburst和GPT-Image-2.5 Flare模型已通过API提供。Flare作为通用版本,具有2.5系列速度、画质与编辑能力,适合社交媒体素材、产品原型、大批量图像生成场景;Sunburst主打高精度精细编辑,面向广告大片、商业产品图等专业生产级视觉内容,图像可控性更强,但生成耗时更长。

在AI图像生成赛道,ChatGPT Images 2.5的核心差异化优势在于深度嵌入对话交互链路。当前市场中,Midjourney在艺术质感、电影感画面输出上仍保持优势,但产品缺少原生对话交互与草图输入能力,上手门槛更高;Adobe Firefly 依托创意软件生态,在商用版权保障方面更有竞争力,但独立对话创作能力偏弱;谷歌 Gemini 内置图像模型在品牌一致性控制上仍存在短板。

据OpenAI 披露,ChatGPT Images系列模型及对应API每周图像产出总量超过 30 亿张。

本次图像模型更新,是OpenAI近期密集产品迭代之一。就在9月3日,公司发布旗舰大模型 GPT-6 Astra,强化自主计算机操作、复杂推理、编程与科研任务处理能力,支持直接识别屏幕像素并模拟键鼠操作,可直接操作各类软件界面,被视作其推进智能体能力的重要一步。

OpenAI 联合创始人兼总裁格雷格・布罗克曼在发布电话会议上表示,“欢迎来到AGI时代”。

9月7日,黄仁勋在社交平台发文称,OpenAI从发布ChatGPT到o1再到Astra只用了4年。“AGI已经到来,恭喜OpenAI团队。”

不过,9月6日,OpenAI首席科学家雅各布・帕乔基(Jakub Pachocki)在官网发布万字长文,称人类已经创造出一套难以完整理解的智能体系,全人类尚未做好应对超级智能快速演进的准备,呼吁全球AI研发主动放缓全速扩张节奏。

未经正式授权严禁转载本文,侵权必究。