OpenAI 发布 ChatGPT Images 2.5 与 Sketch 绘图功能

OpenAI 于本周二正式推出 ChatGPT Images 2.5 版本及全新 Sketch(速写)功能。以下是本次更新的关键硬信息:
- 发布时间:本周二(2026-09-09)
- 新版本:ChatGPT Images 2.5
- 新功能:Sketch 手绘草图输入(通过聊天框输入
@Sketch激活) - 适用用户:ChatGPT、ChatGPT Work 和 Codex 订阅用户
- 可用平台:桌面端、移动端与网页端
- 是否开放访问:当前已全面上线,无需等待预约或测试邀请
Sketch 功能的核心逻辑在于将用户手绘的简单涂鸦作为图像生成的初始提示(prompt),再结合自然语言指令细化输出结果,大幅降低 AI 图像生成的门槛。
功能细节:手绘草图与交互式编辑
Sketch 功能允许用户在 ChatGPT 聊天界面中直接调出画布,用鼠标或触控笔绘制任意图形。据实测反馈,即便草图粗糙(如用鼠标绘制的简笔猫),系统也能根据用户“转换为写实照片”等指令生成高质量图像。此外,新版本支持在图像指定区域添加修改注释——例如用户可圈出猫的眼睛并注明“改为绿色”,系统将在新一轮生成中精准调整局部。
相比传统文本提示,Sketch 背后的技术优势在于将视觉意图直接注入生成流程,减少语言描述误差。OpenAI 官方未披露具体算法细节,但该模式属于多模态提示工程(multimodal prompting),即同时利用图像与文本信号引导模型。
值得注意的是,本次更新将图像生成延迟降低最多 50%(对比 Images 2.0)。这意味着用户从发出指令到获得结果的等待时间显著缩短,尤其适合需要快速迭代设计稿的场景。
技术升级:自然光效与多轮指令优化
ChatGPT Images 2.5 的三大强化方向如下:
- 光影表现:生成图像具备“更自然的光照效果”,减少过曝或阴影失真
- 纹理细节:纹理层次更丰富,材质辨识度提升
- 指令遵循:改进多轮编辑指令的上下文一致性,避免每次修改后前功尽弃
这些改进表明模型对物理世界的理解进一步深化,尤其在处理材质与光照这类高维空间特征时更具鲁棒性。
| 功能对比项 | Images 2.0 | Images 2.5 (新版) |
|---|---|---|
| 图像生成延迟 | 基准值 | 最多降低 50% |
| 光照自然度 | 基础水平 | 更自然的光照效果 |
| 纹理表现力 | 标准 | 更丰富的纹理层次 |
| 多轮指令跟随 | 支持基础编辑 | 显著提升跨多轮一致性 |
| 绘图输入方式 | 文本提示为主 | 新增 Sketch 草图输入 |
适用场景与用户建议
建议尽快尝试的用户群体:
- 非专业设计师:缺乏绘画基础但需要视觉素材的人群,可用 Sketch 快速构建构想雏形
- 创意工作者:插画师、UI 设计师可将速写转为参考素材或迭代草稿
- 教育与原型测试:教师演示抽象概念、工程师快速绘制原型示意图均受益于低门槛输入
建议观望的用户:
- 对图像版权归属有严格要求的商业用户(OpenAI 未在本次通报提及版权政策调整)
- 需生成精细建筑图纸或解剖图谱等专业领域图像者(模型仍可能产生结构性偏差)
写在最后
Sketch 功能的落地标志着 AI 图像生成正从“文字专属”转向“多模态自然交互”阶段。尽管技术路径清晰,但用户真正习惯草图提示还需时间培养——毕竟让全球用户把鼠标当作画笔,仍是一场值得期待的趣味实验。



