模型简介
GPT-Image-1 是 OpenAI 最新的图像生成模型,提供高质量的图片生成能力。本文档介绍如何通过 老张API 使用标准的 OpenAI Image API 格式调用此模型。概述
GPT-Image-1 支持通过文本提示词生成高质量图像,完全兼容 OpenAI 官方的 Image Generation API 格式。主要特性
- 🎨 高质量图像生成:生成细节丰富、符合提示词的图像
- 🚀 快速响应:优化的生成速度,快速获得结果
- 💰 按 Token 计费:输入 $10/M Tokens,输出 $40/M Tokens
- 🔧 完全兼容:100% 兼容 OpenAI Image API 格式
快速开始
基础配置
生成图像
使用标准的 OpenAI Image API 格式调用:API 参数详解
请求参数
参数详细说明
尺寸选项 (size)
1024x1024- 正方形(默认最快生成)1536x1024- 横向/风景模式1024x1536- 纵向/肖像模式auto- 模型根据提示词自动选择最佳尺寸(默认)
质量选项 (quality)
low- 低质量,生成速度最快medium- 中等质量high- 高质量,细节最丰富auto- 模型根据提示词自动选择(默认)
输出格式 (output_format)
png- 无损压缩,默认格式jpeg- 有损压缩,支持压缩级别,生成速度更快webp- 现代格式,文件更小,支持压缩级别
jpeg 或 webp 时,可通过 output_compression 参数控制压缩级别(0-100%)。例如,output_compression=50 将压缩图像 50%。
背景选项 (background)
transparent- 透明背景(适用于 PNG/WebP)opaque- 不透明背景auto- 模型自动选择(默认)
响应格式
使用示例
Python 示例
Node.js 示例
cURL 示例
提示词优化建议
1. 详细描述
提供具体、详细的描述以获得更好的结果:2. 风格指定
明确指定想要的艺术风格:3. 构图和视角
指定构图和视角可以获得更精确的结果:批量生成
批量生成多张图像的示例:错误处理
常见错误码
错误处理示例
最佳实践
1. 提示词长度控制
虽然支持最长 1000 字符,但通常 100-200 字符的详细描述就能获得很好的效果。2. 图像尺寸和质量选择
尺寸建议:1024x1024:通用场景,生成速度最快1536x1024:横向构图,适合风景、横幅1024x1536:纵向构图,适合人像、海报auto:让模型根据内容自动选择
low:快速预览、批量生成medium:日常使用high:专业用途、打印输出auto:模型自动优化
png:需要透明背景或无损质量jpeg:追求速度和更小文件webp:现代 Web 应用,最佳压缩比
3. 内容审核
生成的图像会自动进行内容审核,确保符合使用政策。避免请求生成以下内容:- 暴力或令人不安的图像
- 成人内容
- 仇恨或歧视性内容
- 误导性或虚假信息
- 侵犯版权的内容
4. 成本优化
- 使用较小的尺寸进行测试和预览
- 批量生成时合理设置并发数量
- 缓存生成的图像 URL,避免重复生成
与 Sora Image 的区别
常见问题
Q: 生成的图像可以商用吗?
A: 是的,通过 API 生成的图像您拥有完整的使用权,可以用于商业用途。Q: 图像 URL 的有效期是多久?
A: 生成的图像 URL 通常有效期为 24 小时,建议及时下载保存。Q: 支持中文提示词吗?
A: 支持,但建议使用英文提示词以获得最佳效果。Q: 如何提高生成图像的质量?
A: 使用详细、具体的描述,包括风格、光线、构图等细节。相关资源
GPT-Image-1 采用按 Token 计费模式(输入 $10/M Tokens,输出 $40/M Tokens),实际成本取决于提示词长度和响应内容。相比固定价格的 Sora Image($0.01/张),更适合需要灵活控制成本的场景。