Fal
OpenClaw 随附了一个内置的 fal 提供方,用于托管式图像、视频和音乐生成。
| 属性 | 值 |
|---|---|
| 提供方 | fal |
| 认证 | FAL_KEY(标准;FAL_API_KEY 也可作为备选) |
| API | fal 模型端点(https://fal.run;视频任务使用 https://queue.fal.run) |
| 基础 URL | 可通过 models.providers.fal.baseUrl 覆盖 |
入门指南¶
1. 获取 API 密钥
在 fal.ai/dashboard/keys 创建一个密钥。
2. 设置 API 密钥
非交互式安装可以传入 --fal-api-key <key>,或导出 FAL_KEY 环境变量。Onboarding 流程还会在未配置任何图像模型时,将 fal/fal-ai/flux/dev 设置为默认图像模型。
3. 设置默认图像模型
图像生成¶
内置的 fal 图像生成提供方默认使用 fal/fal-ai/flux/dev。
| 能力 | 值 |
|---|---|
| 最大图像数 | 每个请求 4 张;Krea 2:每个请求 1 张 |
| 尺寸覆盖 | 1024x1024、1024x1536、1536x1024、1024x1792、1792x1024 |
| 宽高比 | 除 Flux 图生图外均支持 |
| 分辨率 | 1K、2K、4K(各模型限制见下文) |
| 输出格式 | png(默认)或 jpeg;GPT Image 2.5 还支持 webp;Krea 2 拒绝覆盖设置 |
编辑请求(通过共享的 image / images 参数传递参考图像)会路由到各模型对应的编辑端点,并带有各模型的参考图像数量限制:
| 模型系列 | fal/ 之后的模型引用 |
编辑端点 | 最大参考图像数 |
|---|---|---|---|
| Flux 及其他 fal 模型 | fal-ai/flux/dev(默认) |
/image-to-image |
1 |
| GPT Image 2.5 | openai/gpt-image-2.5/{flare,sunburst}/text-to-image |
同级 /edit |
16 |
| 旧版 GPT Image | openai/gpt-image-* |
/edit |
10 |
| Grok Imagine | xai/grok-imagine-image |
/edit |
3 |
| Nano Banana(旧版) | fal-ai/nano-banana |
/edit |
3 |
| Nano Banana 2 | fal-ai/nano-banana-* |
/edit |
14 |
| Nano Banana 2 Lite | google/nano-banana-2-lite |
/edit |
14 |
| Krea 2 | krea/v2/{medium,large}/text-to-image |
无(风格参考) | 10 张风格参考 |
Warning
Flux 图生图请求不支持 aspectRatio 覆盖。GPT Image 和 Nano Banana 2 的编辑请求使用 fal 的 /edit 端点,并接受宽高比提示。Nano Banana 2 还接受额外的超宽/超高比例,例如 4:1、1:4、8:1 和 1:8;Krea 2 会校验自己较小的宽高比子集。Grok Imagine 有自己的比例列表(包括 2:1、20:9、19.5:9 及其反向比例),并且只接受 1K/2K 分辨率;旧版 Nano Banana 和 Nano Banana 2 Lite 拒绝 resolution 覆盖。
GPT Image 2.5¶
选择以下任一变体:
fal/openai/gpt-image-2.5/flare/text-to-imagefal/openai/gpt-image-2.5/sunburst/text-to-image
提供参考图像时会选择同级 /edit 端点。你也可以显式选择 fal/openai/gpt-image-2.5/flare/edit 或 fal/openai/gpt-image-2.5/sunburst/edit。
两个变体都支持 quality: "low"、"medium"、"high"、"xhigh"、"max" 或 "auto"。fal 的默认值为 high。它们接受 background: "transparent"、"opaque" 或 "auto"。如需透明背景,请使用 outputFormat: "png" 或 "webp"。这些控制项对旧版 fal 模型不生效。
使用 size: "auto" 或显式尺寸,例如 1536x864。尺寸必须能被 16 整除,且任何一边不得超过 3840 像素。总像素数必须在 655,360 到 8,294,400 之间,宽高比在 1:3 到 3:1 之间。OpenClaw 会将宽高比提示转换为有效尺寸。例如,aspectRatio: "3:2" 会生成 1536x1024。使用 size 可选择精确尺寸。OpenClaw 会拒绝无效的显式尺寸。这些模型拒绝 resolution 覆盖。没有几何提示的编辑请求会沿用 fal 的自动尺寸选择。
openclaw infer image generate \
--model fal/openai/gpt-image-2.5/flare/text-to-image \
--prompt "A simple red circle sticker" \
--quality low --size 1024x1024 --json
openclaw infer image edit \
--model fal/openai/gpt-image-2.5/sunburst/edit \
--file /path/to/reference.png \
--prompt "Keep the shape and change the color to blue" \
--quality low --size auto --json
Krea 2¶
Krea 2 模型使用 fal 原生的 Krea 负载结构。OpenClaw 发送 aspect_ratio、creativity 和 image_style_references,而不是 Flux 使用的通用 image_size / 编辑端点负载。模型引用为:
fal/krea/v2/medium/text-to-imagefal/krea/v2/large/text-to-image
使用 Medium 可获得更快的表现力插画、动漫、绘画和艺术风格。使用 Large 则速度较慢,但可获得照片级逼真、原始纹理、胶片颗粒和精致外观。Krea 默认使用 fal.creativity: "medium";支持的值有 raw、low、medium 和 high。
Krea 2 在 fal 的请求模式中公开的是宽高比,而不是 image_size。优先使用
aspectRatio;OpenClaw 会将 size 映射到最接近的受支持 Krea 宽高比,并且对于 Krea 会拒绝 resolution,而不是直接丢弃它。
当你希望从公开 output_format 的 fal 模型获得 PNG 输出时,请使用 outputFormat: "png"。除 GPT Image 2.5 外,fal 模型在 OpenClaw 中未声明透明背景控制。它们会将 background 报告为被忽略的覆盖项。
Krea 2 端点未通过 fal 公开 output_format 请求字段,因此 OpenClaw 会拒绝 Krea 请求中的 outputFormat 覆盖项。
要使用 Krea 2 Medium:
{
agents: {
defaults: {
mediaModels: {
image: {
primary: "fal/krea/v2/medium/text-to-image",
},
},
},
},
}
视频生成¶
内置的 fal 视频生成提供商默认为
fal/fal-ai/minimax/video-01-live。
| 能力 | 值 |
|---|---|
| 模式 | 文本生成视频、单图参考、Seedance 参考生成视频 |
| 运行时 | 面向长时任务的基于队列的提交/状态/结果流程 |
| 超时 | 默认每个任务 20 分钟;每 5 秒轮询一次状态 |
可用的视频模型
MiniMax(默认):
fal/fal-ai/minimax/video-01-live
HeyGen video-agent:
fal/fal-ai/heygen/v2/video-agent
Kling 和 Wan:
fal/fal-ai/kling-video/v2.1/master/text-to-videofal/fal-ai/wan/v2.2-a14b/text-to-videofal/fal-ai/wan/v2.2-a14b/image-to-video
Seedance 2.0:
fal/bytedance/seedance-2.0/fast/text-to-videofal/bytedance/seedance-2.0/fast/image-to-videofal/bytedance/seedance-2.0/fast/reference-to-videofal/bytedance/seedance-2.0/text-to-videofal/bytedance/seedance-2.0/image-to-videofal/bytedance/seedance-2.0/reference-to-video
MiniMax Live 和 HeyGen 请求仅发送提示词以及可选的单张参考图像;其他覆盖项不会被转发。Seedance 模型
接受 aspectRatio、size、resolution、4-15 秒的时长以及音频开关。
Seedance 2.0 配置示例
Seedance 2.0 参考生成视频配置示例
{
agents: {
defaults: {
mediaModels: {
video: {
primary: "fal/bytedance/seedance-2.0/fast/reference-to-video",
},
},
},
},
}
参考生成视频最多接受 9 张图像、3 个视频和 3 个音频参考,通过共享的 video_generate 的 images、videos 和 audioRefs
参数传入,参考文件总数最多为 12 个。音频参考要求同一请求中至少包含一个图像或视频参考。
HeyGen video-agent 配置示例
音乐生成¶
内置的 fal 插件还为共享的 music_generate 工具注册了音乐生成提供商。
| 能力 | 值 |
|---|---|
| 默认模型 | fal/fal-ai/minimax-music/v2.6 |
| 模型 | fal-ai/minimax-music/v2.6 (mp3), fal-ai/ace-step/prompt-to-audio (wav), fal-ai/stable-audio-25/text-to-audio (wav) |
| 最大时长 | 240 秒 |
| 运行时 | 同步请求并下载生成的音频 |
将 fal 用作默认音乐提供商:
{
agents: {
defaults: {
mediaModels: {
music: {
primary: "fal/fal-ai/minimax-music/v2.6",
},
},
},
},
}
fal-ai/minimax-music/v2.6 支持显式歌词和纯音乐模式,但不能在同一请求中同时使用。ACE-Step 和 Stable Audio 是
提示词转音频端点;当你希望使用这些模型系列时,可通过 model 覆盖项选择它们。ACE-Step 拒绝显式歌词;Stable Audio 拒绝
歌词和纯音乐模式。
Tip
上表及折叠面板涵盖了内置 fal 提供商特殊处理的模型系列。其他 fal 图像端点 ID 仍可作为图像模型选择;它们会被像 Flux 一样处理(通用 image_size 负载,通过 /image-to-image 传入一张参考图像)。
相关¶
共享图像工具参数和提供商选择。
共享视频工具参数和提供商选择。
共享音乐工具参数和提供商选择。
代理默认设置,包括图像、视频和音乐模型选择。
本页原文 Markdown:在 AtomGit 查看·内容源自开源项目 cl/openclaw