跳转至

Vydra

Vydra 官方插件新增以下功能:

  • 图像生成,通过 vydra/grok-imagine
  • 视频生成,通过 vydra/veo3(文本转视频)和 vydra/kling(图像转视频)
  • 语音合成,通过 Vydra 由 ElevenLabs 驱动的 TTS 路由

OpenClaw 对这三种能力使用同一个 VYDRA_API_KEY。

属性 值
提供者 ID vydra
插件 @openclaw/vydra-provider
认证环境变量 VYDRA_API_KEY
引导标志 --auth-choice vydra-api-key
直接 CLI 标志 --vydra-api-key <key>
契约 imageGenerationProviders, videoGenerationProviders, speechProviders
基础 URL https://www.vydra.ai/api/v1(使用 www 主机)

Warning

请使用 https://www.vydra.ai/api/v1 作为基础 URL。Vydra 的根域主机(https://vydra.ai/api/v1)目前会重定向到 www。某些 HTTP 客户端会在这种跨主机重定向时丢弃 Authorization 头,从而将有效的 API 密钥变成令人困惑的认证失败。内置插件会将任何配置为 vydra.ai 的基础 URL 规范化为 www.vydra.ai,以避免此问题。

设置

1. 安装插件

openclaw plugins install @openclaw/vydra-provider

安装会立即应用于正在运行的 Gateway;否则将在下次启动时生效。参见应用更改并检查。

2. 运行交互式引导

openclaw onboard --auth-choice vydra-api-key

或者直接设置环境变量:

export VYDRA_API_KEY="vydra_live_..."

3. 选择默认能力

从下方的能力中选择一个或多个(图像、视频或语音),并应用相应的配置。

能力

图像生成
默认且唯一的 Vydra 图像模型:

- `vydra/grok-imagine`

将其设置为默认图像提供者:

```json5
{
  agents: {
    defaults: {
      mediaModels: {
        image: {
          primary: "vydra/grok-imagine",
        },
      },
    },
  },
}
```

Vydra 仅支持文本转图像,每个请求最多一张图像。Vydra 托管的编辑路由期望远程图像 URL,该插件不会添加 Vydra 专用的上传桥接。

Note

共享工具参数、提供者选择及故障转移行为,请参阅图像生成。

视频生成
已注册的视频模型:

- `vydra/veo3` 用于文本转视频(拒绝图像引用输入)
- `vydra/kling` 用于图像转视频(需要恰好一个远程图像 URL)

将 Vydra 设置为默认视频提供者:

```json5
{
  agents: {
    defaults: {
      mediaModels: {
        video: {
          primary: "vydra/veo3",
        },
      },
    },
  },
}
```

注意:

- `vydra/kling` 会预先拒绝本地文件上传;只有远程图像 URL 引用才有效。
- Vydra 的 `kling` HTTP 路由在要求 `image_url` 还是 `video_url` 上一直不一致;插件会在两个字段中发送相同的远程图像 URL。
- 该插件保持保守,不会转发未文档化的样式选项,例如宽高比、分辨率、水印或生成的音频。

Note

共享工具参数、提供者选择及故障转移行为,请参阅视频生成。

视频实时测试

提供者专属的实时测试覆盖:

OPENCLAW_LIVE_TEST=1 \
OPENCLAW_LIVE_VYDRA_VIDEO=1 \
pnpm test:live -- extensions/vydra/vydra.live.test.ts

Vydra 的实时测试文件涵盖:

  • vydra/veo3 文本转视频
  • vydra/kling 使用远程图像 URL 进行图像转视频

如需覆盖远程图像测试样本:

export OPENCLAW_LIVE_VYDRA_KLING_IMAGE_URL="https://example.com/reference.png"
语音合成

将 Vydra 设置为语音提供者:

{
  tts: {
    provider: "vydra",
    providers: {
      vydra: {
        apiKey: "${VYDRA_API_KEY}",
        voiceId: "21m00Tcm4TlvDq8ikWAM",
      },
    },
  },
}

默认值:

  • 模型:elevenlabs/tts
  • 语音 ID:21m00Tcm4TlvDq8ikWAM(“Rachel”)

该插件公开这一个已知可用的默认语音,并返回 MP3 音频文件。

提供者目录

浏览所有可用提供者。

图像生成

共享的图像工具参数与提供者选择。

视频生成

共享的视频工具参数与提供者选择。

配置参考

Agent 默认配置与模型配置。

本页原文 Markdown:在 AtomGit 查看·内容源自开源项目 cl/openclaw