产品多源确认73°

ChatGPT Images 2.5 发布

ChatGPT Images 2.5 发布 速度、保真度、编辑精度、多轮一致性四个方面相比 Images 2.0 有提升,并新增 Sketch 手绘输入和模板两种使用方式 https://t.co/...

精选理由

OpenAI升级了图像生成模型,速度提升50%,主体保留更好,还支持手绘输入和模板,比2.0好用多了。

ChatGPT Images 2.5 在速度、保真度、编辑精度和多轮一致性四个方面相比 Images 2.0 有提升。延迟最多降低 50%,光照更自然,纹理更丰富,主体在不同场景下更显眼。新增 Sketch 手绘输入和模板两种使用方式,降低创作门槛。

原文 · shao__meng

ChatGPT Images 2.5 发布 速度、保真度、编辑精度、多轮一致性四个方面相比 Images 2.0 有提升,并新增 Sketch 手绘输入和模板两种使用方式 https://t.co/...

ChatGPT Images 2.5 发布 速度、保真度、编辑精度、多轮一致性四个方面相比 Images 2.0 有提升,并新增 Sketch 手绘输入和模板两种使用方式 openai.com/index/introduc… 核心改进:四个维度 1. 速度。 延迟最多降低 50%。对交互式产品来说这不只是体验优化,图像生成从“提交后等待”变成可以连续迭代的对话流,这是生成式工具从演示走向日常生产工具的关键一步。 2. 保真度。 光照更自然、纹理更丰富,更重要的是“参考照片中的主体保留更好”。原文特别指出:主体在不同场景、风格、构图下“更显眼、更易辨认”,对 API 用户而言这意味着“参考引导的工作流”可靠,生成的变体不会偏离原始素材。这直指商业场景中最痛的问题:用产品图、品牌素材做生成时,产品本身不能变形。 3. 精准编辑。 只改指定的部分,其余细节(包括复杂主体和背景)保持不变。API 场景下可以只更新一个元素,换产品、换背景、改文案,而保留主体、构图和品牌风格。这实际上是把“局部重绘”从碰运气变成可依赖的能力。 4. 多轮编辑一致性。 长对话中经过多次编辑后,此前的修改依然保持,质量不随轮次衰减。开发者可以在生产环境做针对性改动而无需每次重建整个素材。这一点对真实工作流的意义可能超过前三项,以往多轮编辑“越改越崩”是所有图像模型的通病。 两个降低门槛的新入口 1. Sketch 是这次最有产品想象力的一项:在 ChatGPT 里直接画草图作为视觉参考,系统将其转化为完整图像,还可以叠加文字描述风格。输入方式是输入 “@ Sketch”。它的定位很明确——“有些想法画出来比描述更容易”。用户不需要会画画,一根线条勾勒出的布局和构图,往往比一段精密的提示词更准确地传达意图。这本质上是给图像模型增加了一条空间/构图先验的输入通道。 2. 模板 则面向“有想法但不知道从哪开始”的用户:海报、周边商品、传单、产品照等热门格式提供起始模板,填入自己的信息、设计元素和风格即可。配合新增的评论式编辑(直接在图片上标注要改哪里)和分享提示词(分享图片时附上所用 prompt,他人可用自己的素材复用同一创意),整个链路从“空白画布”到“传播复用”都被覆盖了。 OpenAI @OpenAI ChatGPT Images 2.5—faster, sharper, smarter, with better tools for creating whatever you can dream of. - Faster image generation to keep your ideas flowing - Improved fidelity for more natural, recognizable images - Consistent details across multiple edits - Comment-based edits to change only what you want Your browser does not support the video tag. 🔗 View on Twitter 🔗 View Quoted Tweet 💬 1 🔄 0 ❤️ 0 👀 240 📊 1 ⚡