跳转至

Fal

OpenClaw 随附了一个内置的 fal 提供方,用于托管式图像、视频和音乐生成。

属性 值
提供方 fal
认证 FAL_KEY(标准;FAL_API_KEY 也可作为备选)
API fal 模型端点(https://fal.run;视频任务使用 https://queue.fal.run)
基础 URL 可通过 models.providers.fal.baseUrl 覆盖

入门指南

1. 获取 API 密钥

在 fal.ai/dashboard/keys 创建一个密钥。

2. 设置 API 密钥

openclaw onboard --auth-choice fal-api-key

非交互式安装可以传入 --fal-api-key <key>,或导出 FAL_KEY 环境变量。Onboarding 流程还会在未配置任何图像模型时,将 fal/fal-ai/flux/dev 设置为默认图像模型。

3. 设置默认图像模型

{
  agents: {
    defaults: {
      mediaModels: {
        image: {
          primary: "fal/fal-ai/flux/dev",
        },
      },
    },
  },
}

图像生成

内置的 fal 图像生成提供方默认使用 fal/fal-ai/flux/dev。

能力 值
最大图像数 每个请求 4 张;Krea 2:每个请求 1 张
尺寸覆盖 1024x1024、1024x1536、1536x1024、1024x1792、1792x1024
宽高比 除 Flux 图生图外均支持
分辨率 1K、2K、4K(各模型限制见下文)
输出格式 png(默认)或 jpeg;GPT Image 2.5 还支持 webp;Krea 2 拒绝覆盖设置

编辑请求(通过共享的 image / images 参数传递参考图像)会路由到各模型对应的编辑端点,并带有各模型的参考图像数量限制:

模型系列 fal/ 之后的模型引用 编辑端点 最大参考图像数
Flux 及其他 fal 模型 fal-ai/flux/dev(默认) /image-to-image 1
GPT Image 2.5 openai/gpt-image-2.5/{flare,sunburst}/text-to-image 同级 /edit 16
旧版 GPT Image openai/gpt-image-* /edit 10
Grok Imagine xai/grok-imagine-image /edit 3
Nano Banana(旧版) fal-ai/nano-banana /edit 3
Nano Banana 2 fal-ai/nano-banana-* /edit 14
Nano Banana 2 Lite google/nano-banana-2-lite /edit 14
Krea 2 krea/v2/{medium,large}/text-to-image 无(风格参考) 10 张风格参考

Warning

Flux 图生图请求不支持 aspectRatio 覆盖。GPT Image 和 Nano Banana 2 的编辑请求使用 fal 的 /edit 端点,并接受宽高比提示。Nano Banana 2 还接受额外的超宽/超高比例,例如 4:1、1:4、8:1 和 1:8;Krea 2 会校验自己较小的宽高比子集。Grok Imagine 有自己的比例列表(包括 2:1、20:9、19.5:9 及其反向比例),并且只接受 1K/2K 分辨率;旧版 Nano Banana 和 Nano Banana 2 Lite 拒绝 resolution 覆盖。

GPT Image 2.5

选择以下任一变体:

  • fal/openai/gpt-image-2.5/flare/text-to-image
  • fal/openai/gpt-image-2.5/sunburst/text-to-image

提供参考图像时会选择同级 /edit 端点。你也可以显式选择 fal/openai/gpt-image-2.5/flare/edit 或 fal/openai/gpt-image-2.5/sunburst/edit。

两个变体都支持 quality: "low"、"medium"、"high"、"xhigh"、"max" 或 "auto"。fal 的默认值为 high。它们接受 background: "transparent"、"opaque" 或 "auto"。如需透明背景,请使用 outputFormat: "png" 或 "webp"。这些控制项对旧版 fal 模型不生效。

使用 size: "auto" 或显式尺寸,例如 1536x864。尺寸必须能被 16 整除,且任何一边不得超过 3840 像素。总像素数必须在 655,360 到 8,294,400 之间,宽高比在 1:3 到 3:1 之间。OpenClaw 会将宽高比提示转换为有效尺寸。例如,aspectRatio: "3:2" 会生成 1536x1024。使用 size 可选择精确尺寸。OpenClaw 会拒绝无效的显式尺寸。这些模型拒绝 resolution 覆盖。没有几何提示的编辑请求会沿用 fal 的自动尺寸选择。

openclaw infer image generate \
  --model fal/openai/gpt-image-2.5/flare/text-to-image \
  --prompt "A simple red circle sticker" \
  --quality low --size 1024x1024 --json

openclaw infer image edit \
  --model fal/openai/gpt-image-2.5/sunburst/edit \
  --file /path/to/reference.png \
  --prompt "Keep the shape and change the color to blue" \
  --quality low --size auto --json

Krea 2

Krea 2 模型使用 fal 原生的 Krea 负载结构。OpenClaw 发送 aspect_ratio、creativity 和 image_style_references,而不是 Flux 使用的通用 image_size / 编辑端点负载。模型引用为:

  • fal/krea/v2/medium/text-to-image
  • fal/krea/v2/large/text-to-image

使用 Medium 可获得更快的表现力插画、动漫、绘画和艺术风格。使用 Large 则速度较慢,但可获得照片级逼真、原始纹理、胶片颗粒和精致外观。Krea 默认使用 fal.creativity: "medium";支持的值有 raw、low、medium 和 high。

Krea 2 在 fal 的请求模式中公开的是宽高比,而不是 image_size。优先使用 aspectRatio;OpenClaw 会将 size 映射到最接近的受支持 Krea 宽高比,并且对于 Krea 会拒绝 resolution,而不是直接丢弃它。

当你希望从公开 output_format 的 fal 模型获得 PNG 输出时,请使用 outputFormat: "png"。除 GPT Image 2.5 外,fal 模型在 OpenClaw 中未声明透明背景控制。它们会将 background 报告为被忽略的覆盖项。 Krea 2 端点未通过 fal 公开 output_format 请求字段,因此 OpenClaw 会拒绝 Krea 请求中的 outputFormat 覆盖项。

要使用 Krea 2 Medium:

{
  agents: {
    defaults: {
      mediaModels: {
        image: {
          primary: "fal/krea/v2/medium/text-to-image",
        },
      },
    },
  },
}

视频生成

内置的 fal 视频生成提供商默认为 fal/fal-ai/minimax/video-01-live。

能力 值
模式 文本生成视频、单图参考、Seedance 参考生成视频
运行时 面向长时任务的基于队列的提交/状态/结果流程
超时 默认每个任务 20 分钟;每 5 秒轮询一次状态
可用的视频模型

MiniMax(默认):

  • fal/fal-ai/minimax/video-01-live

HeyGen video-agent:

  • fal/fal-ai/heygen/v2/video-agent

Kling 和 Wan:

  • fal/fal-ai/kling-video/v2.1/master/text-to-video
  • fal/fal-ai/wan/v2.2-a14b/text-to-video
  • fal/fal-ai/wan/v2.2-a14b/image-to-video

Seedance 2.0:

  • fal/bytedance/seedance-2.0/fast/text-to-video
  • fal/bytedance/seedance-2.0/fast/image-to-video
  • fal/bytedance/seedance-2.0/fast/reference-to-video
  • fal/bytedance/seedance-2.0/text-to-video
  • fal/bytedance/seedance-2.0/image-to-video
  • fal/bytedance/seedance-2.0/reference-to-video

MiniMax Live 和 HeyGen 请求仅发送提示词以及可选的单张参考图像;其他覆盖项不会被转发。Seedance 模型 接受 aspectRatio、size、resolution、4-15 秒的时长以及音频开关。

Seedance 2.0 配置示例
{
  agents: {
    defaults: {
      mediaModels: {
        video: {
          primary: "fal/bytedance/seedance-2.0/fast/text-to-video",
        },
      },
    },
  },
}
Seedance 2.0 参考生成视频配置示例
{
  agents: {
    defaults: {
      mediaModels: {
        video: {
          primary: "fal/bytedance/seedance-2.0/fast/reference-to-video",
        },
      },
    },
  },
}

参考生成视频最多接受 9 张图像、3 个视频和 3 个音频参考,通过共享的 video_generate 的 images、videos 和 audioRefs 参数传入,参考文件总数最多为 12 个。音频参考要求同一请求中至少包含一个图像或视频参考。

HeyGen video-agent 配置示例
{
  agents: {
    defaults: {
      mediaModels: {
        video: {
          primary: "fal/fal-ai/heygen/v2/video-agent",
        },
      },
    },
  },
}

音乐生成

内置的 fal 插件还为共享的 music_generate 工具注册了音乐生成提供商。

能力 值
默认模型 fal/fal-ai/minimax-music/v2.6
模型 fal-ai/minimax-music/v2.6 (mp3), fal-ai/ace-step/prompt-to-audio (wav), fal-ai/stable-audio-25/text-to-audio (wav)
最大时长 240 秒
运行时 同步请求并下载生成的音频

将 fal 用作默认音乐提供商:

{
  agents: {
    defaults: {
      mediaModels: {
        music: {
          primary: "fal/fal-ai/minimax-music/v2.6",
        },
      },
    },
  },
}

fal-ai/minimax-music/v2.6 支持显式歌词和纯音乐模式,但不能在同一请求中同时使用。ACE-Step 和 Stable Audio 是 提示词转音频端点;当你希望使用这些模型系列时,可通过 model 覆盖项选择它们。ACE-Step 拒绝显式歌词;Stable Audio 拒绝 歌词和纯音乐模式。

Tip

上表及折叠面板涵盖了内置 fal 提供商特殊处理的模型系列。其他 fal 图像端点 ID 仍可作为图像模型选择;它们会被像 Flux 一样处理(通用 image_size 负载,通过 /image-to-image 传入一张参考图像)。

图像生成

共享图像工具参数和提供商选择。

视频生成

共享视频工具参数和提供商选择。

音乐生成

共享音乐工具参数和提供商选择。

配置参考

代理默认设置,包括图像、视频和音乐模型选择。

本页原文 Markdown:在 AtomGit 查看·内容源自开源项目 cl/openclaw