图像生成
图像生成¶
捆绑的 openai 插件通过 image_generate 工具注册图像生成。它支持通过相同的 openai/gpt-image-2 模型引用使用 OpenAI API 密钥和 Codex OAuth 进行图像生成。使用 ChatGPT 登录(SIWC)无法授权此工具。此处的 Codex OAuth 指 OpenClaw 模型认证配置文件;仅登录到原生 Codex 用户主目录不会为 image_generate 提供凭据。
| 能力 | OpenAI API 密钥 | Codex OAuth |
|---|---|---|
| 模型引用 | openai/gpt-image-2 |
openai/gpt-image-2 |
| 认证 | OPENAI_API_KEY |
OpenAI Codex OAuth 登录 |
| 传输 | OpenAI Images API | Codex Responses 后端 |
| 每次请求最大图像数 | 4 | 4 |
| 编辑模式 | 已启用(最多 5 张参考图像) | 已启用(最多 5 张参考图像) |
| 审核 | low 或 auto;生成和编辑 |
low 或 auto;生成和编辑 |
| 尺寸覆盖 | 支持,包括 2K/4K 尺寸 | 支持,包括 2K/4K 尺寸 |
| 宽高比 / 分辨率 | 不会转发到 OpenAI Images API | 在安全时映射到受支持的尺寸 |
Note
有关共享工具参数、提供商选择和故障转移行为,请参阅 图像生成。
gpt-image-2 是 OpenAI 文生图生成和图像编辑的默认模型。gpt-image-1.5、gpt-image-1 和 gpt-image-1-mini 仍可作为显式模型覆盖使用。对于透明背景的 PNG/WebP 输出,请使用 openai/gpt-image-1.5;当前 gpt-image-2 API 会拒绝 background: "transparent"。
GPT Image 2.5¶
显式选择 openai/gpt-image-2.5-flare 或 openai/gpt-image-2.5-sunburst。
两者都支持通过直接 Images API 进行生成和编辑。
默认仍为 openai/gpt-image-2。
导出 OPENAI_API_KEY 并选择 API 密钥认证:
{
models: {
providers: {
openai: {
baseUrl: "https://api.openai.com/v1",
auth: "api-key",
models: [],
},
},
},
}
当同时存在 OpenAI OAuth 配置文件时,这种显式选择很重要。 仅导出环境变量不会覆盖该配置文件。 此 API 密钥设置不会建立 GPT Image 2.5 订阅访问权限。
两种变体都接受 low、medium、high、xhigh、max 或 auto 质量。
对于透明背景,请使用 PNG 或 WebP。通过 OpenClaw 进行编辑时,最多可接受 5 张参考图像。
openclaw infer image generate \
--model openai/gpt-image-2.5-flare \
--prompt "A simple red circle sticker on a transparent background" \
--quality low --output-format webp --background transparent --json
openclaw infer image edit \
--model openai/gpt-image-2.5-sunburst \
--file /path/to/reference.png \
--prompt "Keep the shape and change the color to blue" \
--quality low --size auto --json
size 接受 auto 或 WIDTHxHEIGHT。尺寸必须能被 16 整除,
任一边不超过 3840 像素,总像素数介于 655,360 和 8,294,400 之间。
宽高比必须介于 1:3 和 3:1 之间。
其他图像模型¶
对于透明背景请求,请调用 image_generate,并设置
model: "openai/gpt-image-1.5"、outputFormat: "png" 或 "webp",以及
background: "transparent";旧的 openai.background 提供商选项仍会被接受。OpenClaw 还会保护公开的 OpenAI 和 OpenAI Codex OAuth
路由,将默认的 openai/gpt-image-2 透明请求重写为
gpt-image-1.5;Azure 和自定义 OpenAI 兼容端点会保留其配置的部署/模型名称。
相同的设置也暴露给无头 CLI 运行:
openclaw infer image generate \
--model openai/gpt-image-1.5 \
--output-format png \
--background transparent \
--prompt "A simple red circle sticker on a transparent background" \
--json
当从输入文件开始时,对 openclaw infer image edit 使用相同的
--output-format 和 --background 标志。
--openai-background 仍可作为 OpenAI 专用别名使用。使用
--quality low|medium|high|auto 来控制 OpenAI Images 质量和成本。
对 image generate 和 image edit 都使用 --openai-moderation low|auto
以传递 OpenAI 的审核提示。直接 OpenAI Images API 和
ChatGPT/Codex OAuth Responses 后端都支持文生图生成和参考图像编辑的审核。
对于 ChatGPT/Codex OAuth 安装,请保留相同的 openai/gpt-image-2 引用。当
配置了 openai OAuth 配置文件时,OpenClaw 会解析该存储的 OAuth
访问令牌,并通过 Codex Responses 后端发送图像请求;它
不会先尝试 OPENAI_API_KEY,也不会静默回退到 API 密钥。
如果你希望改用直接 OpenAI Images API 路由,请显式使用 API 密钥、自定义基础
URL 或 Azure 端点配置 models.providers.openai。如果该自定义图像端点位于受信任的 LAN/私有地址上,
还请设置 browser.ssrfPolicy.dangerouslyAllowPrivateNetwork: true;OpenClaw
除非存在此选择加入设置,会保持阻止私有/内部 OpenAI 兼容图像端点。
生成:
/tool image_generate model=openai/gpt-image-2 prompt="A polished launch poster for OpenClaw on macOS" size=3840x2160 count=1
生成透明 PNG:
/tool image_generate model=openai/gpt-image-1.5 prompt="A simple red circle sticker on a transparent background" outputFormat=png background=transparent
编辑:
/tool image_generate model=openai/gpt-image-2 prompt="Preserve the object shape, change the material to translucent glass" image=/path/to/reference.png size=1024x1536
OpenAI 已于 2026-09-24 停用其 Sora 视频 API;支持的提供商请参阅 视频生成。
本页原文 Markdown:在 AtomGit 查看·内容源自开源项目 cl/openclaw