跳转至

图像生成

图像生成

捆绑的 openai 插件通过 image_generate 工具注册图像生成。它支持通过相同的 openai/gpt-image-2 模型引用使用 OpenAI API 密钥和 Codex OAuth 进行图像生成。使用 ChatGPT 登录(SIWC)无法授权此工具。此处的 Codex OAuth 指 OpenClaw 模型认证配置文件;仅登录到原生 Codex 用户主目录不会为 image_generate 提供凭据。

能力 OpenAI API 密钥 Codex OAuth
模型引用 openai/gpt-image-2 openai/gpt-image-2
认证 OPENAI_API_KEY OpenAI Codex OAuth 登录
传输 OpenAI Images API Codex Responses 后端
每次请求最大图像数 4 4
编辑模式 已启用(最多 5 张参考图像) 已启用(最多 5 张参考图像)
审核 low 或 auto;生成和编辑 low 或 auto;生成和编辑
尺寸覆盖 支持,包括 2K/4K 尺寸 支持,包括 2K/4K 尺寸
宽高比 / 分辨率 不会转发到 OpenAI Images API 在安全时映射到受支持的尺寸
{
  agents: {
    defaults: {
      mediaModels: { image: { primary: "openai/gpt-image-2" } },
    },
  },
}

Note

有关共享工具参数、提供商选择和故障转移行为,请参阅 图像生成。

gpt-image-2 是 OpenAI 文生图生成和图像编辑的默认模型。gpt-image-1.5、gpt-image-1 和 gpt-image-1-mini 仍可作为显式模型覆盖使用。对于透明背景的 PNG/WebP 输出,请使用 openai/gpt-image-1.5;当前 gpt-image-2 API 会拒绝 background: "transparent"。

GPT Image 2.5

显式选择 openai/gpt-image-2.5-flare 或 openai/gpt-image-2.5-sunburst。 两者都支持通过直接 Images API 进行生成和编辑。 默认仍为 openai/gpt-image-2。

导出 OPENAI_API_KEY 并选择 API 密钥认证:

{
  models: {
    providers: {
      openai: {
        baseUrl: "https://api.openai.com/v1",
        auth: "api-key",
        models: [],
      },
    },
  },
}

当同时存在 OpenAI OAuth 配置文件时,这种显式选择很重要。 仅导出环境变量不会覆盖该配置文件。 此 API 密钥设置不会建立 GPT Image 2.5 订阅访问权限。

两种变体都接受 low、medium、high、xhigh、max 或 auto 质量。 对于透明背景,请使用 PNG 或 WebP。通过 OpenClaw 进行编辑时,最多可接受 5 张参考图像。

openclaw infer image generate \
  --model openai/gpt-image-2.5-flare \
  --prompt "A simple red circle sticker on a transparent background" \
  --quality low --output-format webp --background transparent --json

openclaw infer image edit \
  --model openai/gpt-image-2.5-sunburst \
  --file /path/to/reference.png \
  --prompt "Keep the shape and change the color to blue" \
  --quality low --size auto --json

size 接受 auto 或 WIDTHxHEIGHT。尺寸必须能被 16 整除, 任一边不超过 3840 像素,总像素数介于 655,360 和 8,294,400 之间。 宽高比必须介于 1:3 和 3:1 之间。

其他图像模型

对于透明背景请求,请调用 image_generate,并设置 model: "openai/gpt-image-1.5"、outputFormat: "png" 或 "webp",以及 background: "transparent";旧的 openai.background 提供商选项仍会被接受。OpenClaw 还会保护公开的 OpenAI 和 OpenAI Codex OAuth 路由,将默认的 openai/gpt-image-2 透明请求重写为 gpt-image-1.5;Azure 和自定义 OpenAI 兼容端点会保留其配置的部署/模型名称。

相同的设置也暴露给无头 CLI 运行:

openclaw infer image generate \
  --model openai/gpt-image-1.5 \
  --output-format png \
  --background transparent \
  --prompt "A simple red circle sticker on a transparent background" \
  --json

当从输入文件开始时,对 openclaw infer image edit 使用相同的 --output-format 和 --background 标志。 --openai-background 仍可作为 OpenAI 专用别名使用。使用 --quality low|medium|high|auto 来控制 OpenAI Images 质量和成本。 对 image generate 和 image edit 都使用 --openai-moderation low|auto 以传递 OpenAI 的审核提示。直接 OpenAI Images API 和 ChatGPT/Codex OAuth Responses 后端都支持文生图生成和参考图像编辑的审核。

对于 ChatGPT/Codex OAuth 安装,请保留相同的 openai/gpt-image-2 引用。当 配置了 openai OAuth 配置文件时,OpenClaw 会解析该存储的 OAuth 访问令牌,并通过 Codex Responses 后端发送图像请求;它 不会先尝试 OPENAI_API_KEY,也不会静默回退到 API 密钥。 如果你希望改用直接 OpenAI Images API 路由,请显式使用 API 密钥、自定义基础 URL 或 Azure 端点配置 models.providers.openai。如果该自定义图像端点位于受信任的 LAN/私有地址上, 还请设置 browser.ssrfPolicy.dangerouslyAllowPrivateNetwork: true;OpenClaw 除非存在此选择加入设置,会保持阻止私有/内部 OpenAI 兼容图像端点。

生成:

/tool image_generate model=openai/gpt-image-2 prompt="A polished launch poster for OpenClaw on macOS" size=3840x2160 count=1

生成透明 PNG:

/tool image_generate model=openai/gpt-image-1.5 prompt="A simple red circle sticker on a transparent background" outputFormat=png background=transparent

编辑:

/tool image_generate model=openai/gpt-image-2 prompt="Preserve the object shape, change the material to translucent glass" image=/path/to/reference.png size=1024x1536

OpenAI 已于 2026-09-24 停用其 Sora 视频 API;支持的提供商请参阅 视频生成。

本页原文 Markdown:在 AtomGit 查看·内容源自开源项目 cl/openclaw