Skip to main content

模型简介

GPT-Image-1 是 OpenAI 最新的图像生成模型,提供高质量的图片生成能力。本文档介绍如何通过 老张API 使用标准的 OpenAI Image API 格式调用此模型。

概述

GPT-Image-1 支持通过文本提示词生成高质量图像,完全兼容 OpenAI 官方的 Image Generation API 格式。

主要特性

  • 🎨 高质量图像生成:生成细节丰富、符合提示词的图像
  • 🚀 快速响应:优化的生成速度,快速获得结果
  • 💰 按 Token 计费:输入 $10/M Tokens,输出 $40/M Tokens
  • 🔧 完全兼容:100% 兼容 OpenAI Image API 格式

快速开始

基础配置

生成图像

使用标准的 OpenAI Image API 格式调用:

API 参数详解

请求参数

参数详细说明

尺寸选项 (size)

  • 1024x1024 - 正方形(默认最快生成)
  • 1536x1024 - 横向/风景模式
  • 1024x1536 - 纵向/肖像模式
  • auto - 模型根据提示词自动选择最佳尺寸(默认)

质量选项 (quality)

  • low - 低质量,生成速度最快
  • medium - 中等质量
  • high - 高质量,细节最丰富
  • auto - 模型根据提示词自动选择(默认)
性能提示:正方形图像 + 标准质量生成速度最快。如果对延迟敏感,建议使用 jpeg 格式而非 png

输出格式 (output_format)

  • png - 无损压缩,默认格式
  • jpeg - 有损压缩,支持压缩级别,生成速度更快
  • webp - 现代格式,文件更小,支持压缩级别
使用 jpegwebp 时,可通过 output_compression 参数控制压缩级别(0-100%)。例如,output_compression=50 将压缩图像 50%。

背景选项 (background)

  • transparent - 透明背景(适用于 PNG/WebP)
  • opaque - 不透明背景
  • auto - 模型自动选择(默认)

响应格式

使用示例

Python 示例

Node.js 示例

cURL 示例

提示词优化建议

1. 详细描述

提供具体、详细的描述以获得更好的结果:

2. 风格指定

明确指定想要的艺术风格:

3. 构图和视角

指定构图和视角可以获得更精确的结果:

批量生成

批量生成多张图像的示例:

错误处理

常见错误码

错误处理示例

最佳实践

1. 提示词长度控制

虽然支持最长 1000 字符,但通常 100-200 字符的详细描述就能获得很好的效果。

2. 图像尺寸和质量选择

尺寸建议
  • 1024x1024:通用场景,生成速度最快
  • 1536x1024:横向构图,适合风景、横幅
  • 1024x1536:纵向构图,适合人像、海报
  • auto:让模型根据内容自动选择
质量建议
  • low:快速预览、批量生成
  • medium:日常使用
  • high:专业用途、打印输出
  • auto:模型自动优化
格式选择
  • png:需要透明背景或无损质量
  • jpeg:追求速度和更小文件
  • webp:现代 Web 应用,最佳压缩比

3. 内容审核

生成的图像会自动进行内容审核,确保符合使用政策。避免请求生成以下内容:
  • 暴力或令人不安的图像
  • 成人内容
  • 仇恨或歧视性内容
  • 误导性或虚假信息
  • 侵犯版权的内容

4. 成本优化

  • 使用较小的尺寸进行测试和预览
  • 批量生成时合理设置并发数量
  • 缓存生成的图像 URL,避免重复生成

与 Sora Image 的区别

常见问题

Q: 生成的图像可以商用吗?

A: 是的,通过 API 生成的图像您拥有完整的使用权,可以用于商业用途。

Q: 图像 URL 的有效期是多久?

A: 生成的图像 URL 通常有效期为 24 小时,建议及时下载保存。

Q: 支持中文提示词吗?

A: 支持,但建议使用英文提示词以获得最佳效果。

Q: 如何提高生成图像的质量?

A: 使用详细、具体的描述,包括风格、光线、构图等细节。

相关资源

GPT-Image-1 采用按 Token 计费模式(输入 $10/M Tokens,输出 $40/M Tokens),实际成本取决于提示词长度和响应内容。相比固定价格的 Sora Image($0.01/张),更适合需要灵活控制成本的场景。