Skip to main content
GPT-Image 系列适合高质量图像生成、图像编辑、广告素材、UI 概念图、电商主图和多语言视觉内容。AIOAGI 当前文档将 GPT-Image 系列放在图像生成模型分类下,便于你和 banana 等其他图像模型系列分开选型。
图像模型名称、价格、分辨率、质量档位和上线状态可能变化。请在 控制台开发者指南 中核对当前可用模型,再上线生产调用。

系列定位

GPT-Image-2

面向更高质量的图像生成与编辑。适合文字渲染、真实感、UI 截图、多语言海报和高分辨率素材等场景。

GPT-Image-1.5

面向稳定生产和通用创意生成。适合常规海报、插画、电商素材、图像编辑和标准比例输出。
GPT-Image 系列架构与能力演进路径

GPT-Image-2

GPT-Image-2 是 AIOAGI 平台提供的新一代高质量图像生成模型。相比 GPT-Image-1.5,它更适合对文字渲染、真实感、生成速度、高分辨率、多语言和 UI 还原能力要求更高的任务。 适合优先尝试 GPT-Image-2 的场景:
  • 你需要在图片中生成稳定可读的标题、招牌、菜单、标签或 UI 文案。
  • 你需要更强的真实感,例如产品图、人物场景、室内外环境和商业主视觉。
  • 你需要生成 UI mockup、网页截图风格素材、教程插图或应用界面概念图。
  • 你需要多语言图片素材,例如中文、英文和跨境电商本地化广告。
  • 你希望减少后期修图、超分、排版和局部修补成本。
GPT-Image-2 与 GPT-Image-1.5 综合能力对比

GPT-Image-1.5

GPT-Image-1.5 是成熟的 GPT 图像模型,适合多数常规生成和编辑任务。它支持文本提示词和图像输入,可用于图片生成、图片编辑、风格转换和素材改写等工作流。 适合继续使用 GPT-Image-1.5 的场景:
  • 你已经有稳定的生产工作流,暂时不需要高分辨率或复杂文字生成。
  • 你主要生成插画、海报草图、产品概念图和社交媒体配图。
  • 你的图片中只有短标题或少量文字,且允许人工复核。
  • 你更重视可预测的成本、接口兼容和已有提示词模板复用。

核心差异

GPT-Image-2 与 GPT-Image-1.5 核心性能对比

迁移建议

如果你已经在 AIOAGI 中使用 GPT-Image-1.5,可以按以下方式评估 GPT-Image-2
  1. 先复制现有提示词和参数,保持 promptsizequalityoutput_format 不变。
  2. 仅将 modelgpt-image-1.5 切换为 gpt-image-2 做 A/B 对比。
  3. 对比文字准确性、主体一致性、真实感、出图耗时和返工成本。
  4. 对高价值业务场景先灰度,例如广告主图、UI 教程图和电商详情页。
  5. 记录失败样例,并在提示词中补充版式、文字、风格和尺寸要求。
如果你需要直接调用接口,请查看 API 开发文档中的 GPT-Image系列 页面。该页面包含 /images/generations/images/edits 的 Python 示例。