Volcengine (Doubao)
Volcengine 提供方允许访问托管在火山引擎上的 Doubao 模型和第三方模型,并为通用与编程工作负载提供独立的端点。该官方插件同时还会将 Volcengine Speech 注册为 TTS 提供方。
| 详情 | 值 |
|---|---|
| 提供方 | volcengine(通用 + TTS)、volcengine-plan(编程) |
| 模型认证 | VOLCANO_ENGINE_API_KEY |
| TTS 认证 | VOLCENGINE_TTS_API_KEY 或 BYTEPLUS_SEED_SPEECH_API_KEY |
| API | OpenAI 兼容模型、BytePlus Seed Speech TTS |
快速开始¶
1. 安装插件
安装会自动应用到正在运行的 Gateway;否则将在下次启动时生效。请参阅应用更改并检查。
2. 设置 API 密钥
运行交互式引导:
这会通过同一个 API 密钥同时注册通用(volcengine)和编程(volcengine-plan)提供方。
3. 设置默认模型
4. 验证模型可用
Tip
对于非交互式设置(CI、脚本),请直接传入密钥:
提供方与端点¶
| 提供方 | 端点 | 用途 |
|---|---|---|
volcengine |
ark.cn-beijing.volces.com/api/v3 |
通用模型 |
volcengine-plan |
ark.cn-beijing.volces.com/api/coding/v3 |
编程模型 |
Note
两个提供方都由同一个 API 密钥配置。设置会自动注册两者,编程提供方的模型选择器也会复用通用提供方的认证(volcengine-plan 是 volcengine 的认证别名)。
内置目录¶
| 模型引用 | 名称 | 输入 | 上下文 |
|---|---|---|---|
volcengine/doubao-seed-evolving |
Doubao Seed Evolving | 文本、图像、视频 | 1,024,000 |
volcengine/doubao-seed-2-1-pro-260628 |
Doubao Seed 2.1 Pro | 文本、图像、视频 | 256,000 |
volcengine/doubao-seed-2-1-turbo-260628 |
Doubao Seed 2.1 Turbo | 文本、图像、视频 | 256,000 |
volcengine/glm-5-2-260617 |
GLM 5.2 | 文本 | 1,024,000 |
volcengine/deepseek-v4-pro-260425 |
DeepSeek V4 Pro | 文本 | 1,024,000 |
volcengine/deepseek-v4-flash-260425 |
DeepSeek V4 Flash | 文本 | 1,024,000 |
| 模型引用 | 名称 | 输入 | 上下文 |
|---|---|---|---|
volcengine-plan/ark-code-latest |
Ark Coding Plan | 文本 | 256,000 |
volcengine-plan/doubao-seed-2.1-turbo |
Doubao Seed 2.1 Turbo | 文本、图像、视频 | 256,000 |
volcengine-plan/glm-5.2 |
GLM 5.2 | 文本 | 1,024,000 |
volcengine-plan/deepseek-v4-pro |
DeepSeek V4 Pro | 文本 | 1,024,000 |
volcengine-plan/deepseek-v4-flash |
DeepSeek V4 Flash | 文本 | 1,024,000 |
两个目录均为静态目录(不执行 /models 发现调用),并支持 OpenAI 兼容的流式用量统计。由于 Volcengine 的工具调用 API 会拒绝 minLength、maxLength、minItems、maxItems、minContains 和 maxContains 关键字,因此两个提供方的工具模式会自动移除这些关键字。
文本转语音¶
Volcengine TTS 使用 BytePlus Seed Speech HTTP API(voice.ap-southeast-1.bytepluses.com),并且与 OpenAI 兼容的 Doubao 模型 API 密钥分开配置。在 BytePlus 控制台中,打开 Seed Speech > 设置 > API 密钥,复制 API 密钥,然后设置:
export VOLCENGINE_TTS_API_KEY="<seed-speech-api-key>"
export VOLCENGINE_TTS_RESOURCE_ID="seed-tts-1.0"
然后在 openclaw.json 中启用:
{
tts: {
auto: "always",
provider: "volcengine",
providers: {
volcengine: {
apiKey: "${VOLCENGINE_TTS_API_KEY}",
voice: "en_female_anna_mars_bigtts",
speedRatio: 1.0,
},
},
},
}
tts.providers.volcengine 下可用的字段包括 apiKey、voice、speedRatio(0.2-3.0)、emotion、cluster、resourceId、appKey 和 baseUrl。当允许覆盖语音设置时,!emotion=<value> 也可以作为内联语音指令使用。
对于语音留言目标,OpenClaw 会请求提供方原生的 ogg_opus 格式。对于普通音频附件,它会请求 mp3 格式。提供方别名 bytedance 和 doubao 也会解析到此语音提供方。
默认资源 ID 是 seed-tts-1.0,这是 BytePlus 默认授予新创建的 Seed Speech API 密钥的权限。如果您的项目拥有 TTS 2.0 权限,请设置 VOLCENGINE_TTS_RESOURCE_ID=seed-tts-2.0。
Warning
VOLCANO_ENGINE_API_KEY 用于 ModelArk/Doubao 模型端点,不是 Seed Speech API 密钥。TTS 需要从 BytePlus Speech 控制台获取 Seed Speech API 密钥,或使用旧版 Speech 控制台的 AppID/token 凭据对。
旧版 AppID/token 认证仍受支持,适用于较早的 Speech Console 应用:
export VOLCENGINE_TTS_APPID="speech_app_id"
export VOLCENGINE_TTS_TOKEN="speech_access_token"
export VOLCENGINE_TTS_CLUSTER="volcano_tts"
其他可选 TTS 环境变量:VOLCENGINE_TTS_VOICE、VOLCENGINE_TTS_APP_KEY 和 VOLCENGINE_TTS_BASE_URL 在设置时会覆盖对应的 tts.providers.volcengine 配置字段。
高级配置¶
引导后的默认模型
openclaw onboard --auth-choice volcengine-api-key 会将 volcengine-plan/ark-code-latest 设置为默认模型,同时注册通用的 volcengine 目录。
模型选择器回退行为
在引导/配置模型选择期间,Volcengine 认证选项会优先选择 volcengine/* 和 volcengine-plan/* 行。如果这些模型尚未加载,OpenClaw 会回退到未过滤的目录,而不是显示空的按提供商范围划分的模型选择器。
守护进程的环境变量
如果 Gateway 作为守护进程(launchd/systemd)运行,请确保模型和 TTS 环境变量(例如 VOLCANO_ENGINE_API_KEY、VOLCENGINE_TTS_API_KEY、BYTEPLUS_SEED_SPEECH_API_KEY、VOLCENGINE_TTS_APPID 和 VOLCENGINE_TTS_TOKEN)对该进程可用(例如,在 ~/.openclaw/.env 中或通过 env.shellEnv)。
Warning
当将 OpenClaw 作为后台服务运行时,在交互式 shell 中设置的环境变量不会被自动继承。请参阅上面的守护进程说明。
相关¶
选择提供商、模型引用和故障转移行为。
代理、模型和提供商的完整配置参考。
常见问题和调试步骤。
关于 OpenClaw 设置的常见问题。
本页原文 Markdown:在 AtomGit 查看·内容源自开源项目 cl/openclaw