Inworld
Inworld 是一个流式文本转语音(TTS)提供商。在 OpenClaw 中,它合成外发回复音频(默认 MP3,语音留言使用 OGG_OPUS)以及用于 Voice Call 等电话通道的原始 PCM 音频。
OpenClaw 向 Inworld 的流式 TTS 端点发送请求,将返回的 base64 音频块拼接成单个缓冲区,并将结果交给标准回复音频流水线。
| 属性 | 值 |
|---|---|
| 提供商 ID | inworld |
| 插件 | 官方外部包(@openclaw/inworld-speech) |
| 契约 | speechProviders(仅 TTS) |
| 认证环境变量 | INWORLD_API_KEY(HTTP Basic,Base64 仪表盘凭据) |
| 基础 URL | https://api.inworld.ai |
| 默认语音 | Sarah |
| 默认模型 | inworld-tts-1.5-max |
| 输出 | MP3(默认)、OGG_OPUS(语音留言)、PCM 22050 Hz(电话) |
| 网站 | inworld.ai |
| 文档 | docs.inworld.ai/tts/tts |
安装插件¶
安装会自动应用于正在运行的 Gateway;否则,它将在下次启动时生效。参见 应用更改并检查.
快速开始¶
1. 设置你的 API 密钥
从 Inworld 仪表盘(Workspace > API Keys)复制凭据,并将其设置为环境变量。该值会按原样作为 HTTP Basic 凭据发送,因此请勿再次进行 Base64 编码,也不要将其转换为 bearer token。
2. 在 tts 中选择 Inworld
{
tts: {
auto: "always",
provider: "inworld",
providers: {
inworld: {
voiceId: "Sarah",
modelId: "inworld-tts-1.5-max",
},
},
},
}
3. 发送消息
通过任意已连接通道发送回复。OpenClaw 使用 Inworld 合成音频,并以 MP3 形式发送(当通道期望语音留言时,则使用 OGG_OPUS)。
配置选项¶
| 选项 | 路径 | 描述 |
|---|---|---|
apiKey |
tts.providers.inworld.apiKey |
Base64 仪表盘凭据。回退到 INWORLD_API_KEY。 |
baseUrl |
tts.providers.inworld.baseUrl |
覆盖 Inworld API 基础 URL(默认 https://api.inworld.ai)。 |
voiceId |
tts.providers.inworld.voiceId |
语音标识符(默认 Sarah)。旧版别名:speakerVoiceId。 |
modelId |
tts.providers.inworld.modelId |
TTS 模型 ID(默认 inworld-tts-1.5-max)。 |
temperature |
tts.providers.inworld.temperature |
采样温度,0(不含)到 2(可选)。 |
备注¶
身份验证
Inworld 使用 HTTP Basic 身份验证,并采用单个 Base64 编码的凭据字符串。请从 Inworld 仪表盘原样复制。提供商会将其作为 Authorization: Basic <apiKey> 发送,且不再进行任何编码,因此请勿自行进行 Base64 编码,也不要传入 bearer 风格的 token。有关相同提示,参见 TTS 身份验证说明。
模型
支持的模型 ID:inworld-tts-1.5-max(默认)、inworld-tts-1.5-mini、inworld-tts-1-max、inworld-tts-1。
音频输出
回复默认使用 MP3。当通道目标为 voice-note 时,OpenClaw 会请求 Inworld 返回 OGG_OPUS,以便音频作为原生语音气泡播放。电话合成使用 22050 Hz 的原始 PCM 来馈送电话桥接。
自定义端点
使用 tts.providers.inworld.baseUrl 覆盖 API 主机。发送请求前会去除末尾斜杠。
相关¶
TTS 概览、提供商以及 tts 配置。
完整配置参考,包括 tts 设置。
所有受支持的 OpenClaw 提供商。
常见问题和调试步骤。
本页原文 Markdown:在 AtomGit 查看·内容源自开源项目 cl/openclaw