Featured image of post OpenAI 推出 ChatGPT Images 2.5 与 Sketch 绘图功能:潦草涂鸦秒变高清 AI 图像

OpenAI 推出 ChatGPT Images 2.5 与 Sketch 绘图功能:潦草涂鸦秒变高清 AI 图像

OpenAI 发布图像生成新版本与手绘草图功能,支持用户直接在 ChatGPT 内绘制并优化图像。

OpenAI 发布 ChatGPT Images 2.5 与 Sketch 绘图功能

OpenAI 发布 ChatGPT Images 2.5 与 Sketch 绘图功能
OpenAI 发布 ChatGPT Images 2.5 与 Sketch 绘图功能|新闻截图

OpenAI 于本周二正式推出 ChatGPT Images 2.5 版本及全新 Sketch(速写)功能。以下是本次更新的关键硬信息:

  • 发布时间:本周二(2026-09-09)
  • 新版本:ChatGPT Images 2.5
  • 新功能:Sketch 手绘草图输入(通过聊天框输入 @Sketch 激活)
  • 适用用户:ChatGPT、ChatGPT Work 和 Codex 订阅用户
  • 可用平台:桌面端、移动端与网页端
  • 是否开放访问:当前已全面上线,无需等待预约或测试邀请

Sketch 功能的核心逻辑在于将用户手绘的简单涂鸦作为图像生成的初始提示(prompt),再结合自然语言指令细化输出结果,大幅降低 AI 图像生成的门槛。

功能细节:手绘草图与交互式编辑

功能细节:手绘草图与交互式编辑
功能细节:手绘草图与交互式编辑|新闻截图

Sketch 功能允许用户在 ChatGPT 聊天界面中直接调出画布,用鼠标或触控笔绘制任意图形。据实测反馈,即便草图粗糙(如用鼠标绘制的简笔猫),系统也能根据用户“转换为写实照片”等指令生成高质量图像。此外,新版本支持在图像指定区域添加修改注释——例如用户可圈出猫的眼睛并注明“改为绿色”,系统将在新一轮生成中精准调整局部。

相比传统文本提示,Sketch 背后的技术优势在于将视觉意图直接注入生成流程,减少语言描述误差。OpenAI 官方未披露具体算法细节,但该模式属于多模态提示工程(multimodal prompting),即同时利用图像与文本信号引导模型。

值得注意的是,本次更新将图像生成延迟降低最多 50%(对比 Images 2.0)。这意味着用户从发出指令到获得结果的等待时间显著缩短,尤其适合需要快速迭代设计稿的场景。

技术升级:自然光效与多轮指令优化

技术升级:自然光效与多轮指令优化
技术升级:自然光效与多轮指令优化|新闻截图

ChatGPT Images 2.5 的三大强化方向如下:

  • 光影表现:生成图像具备“更自然的光照效果”,减少过曝或阴影失真
  • 纹理细节:纹理层次更丰富,材质辨识度提升
  • 指令遵循:改进多轮编辑指令的上下文一致性,避免每次修改后前功尽弃

这些改进表明模型对物理世界的理解进一步深化,尤其在处理材质与光照这类高维空间特征时更具鲁棒性。

功能对比项Images 2.0Images 2.5 (新版)
图像生成延迟基准值最多降低 50%
光照自然度基础水平更自然的光照效果
纹理表现力标准更丰富的纹理层次
多轮指令跟随支持基础编辑显著提升跨多轮一致性
绘图输入方式文本提示为主新增 Sketch 草图输入

适用场景与用户建议

适用场景与用户建议
适用场景与用户建议|新闻截图

建议尽快尝试的用户群体:

  • 非专业设计师:缺乏绘画基础但需要视觉素材的人群,可用 Sketch 快速构建构想雏形
  • 创意工作者:插画师、UI 设计师可将速写转为参考素材或迭代草稿
  • 教育与原型测试:教师演示抽象概念、工程师快速绘制原型示意图均受益于低门槛输入

建议观望的用户:

  • 图像版权归属有严格要求的商业用户(OpenAI 未在本次通报提及版权政策调整)
  • 需生成精细建筑图纸或解剖图谱等专业领域图像者(模型仍可能产生结构性偏差)

写在最后

Sketch 功能的落地标志着 AI 图像生成正从“文字专属”转向“多模态自然交互”阶段。尽管技术路径清晰,但用户真正习惯草图提示还需时间培养——毕竟让全球用户把鼠标当作画笔,仍是一场值得期待的趣味实验。