跳转至

SenseAudio

SenseAudio 通过 OpenClaw 共享的 tools.media.audio 管线转写传入的音频和语音留言附件。OpenClaw 将 multipart 音频发送到兼容 OpenAI 的转写端点,并把返回的文本作为 {{Transcript}} 以及一个 [Audio] 块注入。

属性 值
提供商 ID senseaudio
插件 内置,enabledByDefault: true
契约 mediaUnderstandingProviders(音频)
认证环境变量 SENSEAUDIO_API_KEY
默认模型 senseaudio-asr-pro-1.5-260319
默认 URL https://api.senseaudio.cn/v1
网站 senseaudio.cn
文档 docs.senseaudio.cn

开始使用

1. 设置你的 API 密钥

export SENSEAUDIO_API_KEY="..."

2. 启用音频提供商

{
  tools: {
    media: {
      models: [
        {
          provider: "senseaudio",
          model: "senseaudio-asr-pro-1.5-260319",
          capabilities: ["audio"],
        },
      ],
      audio: {
        enabled: true,
      },
    },
  },
}

3. 发送语音留言

通过任意已连接渠道发送音频消息。OpenClaw 会将音频上传到 SenseAudio,并在回复管线中使用转写文本。

选项

选项 路径 描述
model tools.media.models[].model SenseAudio ASR 模型 ID
language tools.media.models[].language 可选的语言提示
prompt tools.media.models[].prompt 可选的转写提示
baseUrl tools.media.models[].baseUrl 覆盖 OpenAI 兼容的基础 URL
headers tools.media.models[].headers 额外的请求头

Note

SenseAudio 在 OpenClaw 中仅支持批量 STT。语音通话 的实时转写继续使用支持流式 STT 的提供商。

本页原文 Markdown:在 AtomGit 查看·内容源自开源项目 cl/openclaw