跳转至

DeepInfra

DeepInfra 通过单个 OpenAI 兼容端点和 API 密钥,将请求路由到热门开源模型和前沿模型。大多数 OpenAI SDK 通过切换 base URL 即可使用它。

安装插件

openclaw plugins install @openclaw/deepinfra-provider

安装会自动应用于正在运行的 Gateway;否则将在下次启动时生效。参见 应用更改并检查。

获取 API 密钥

  1. 登录 deepinfra.com
  2. 前往 Dashboard / Keys 并生成密钥,或使用自动创建的密钥

CLI 设置

openclaw onboard --deepinfra-api-key <key>

或设置环境变量:

export DEEPINFRA_API_KEY="<your-deepinfra-api-key>" # pragma: allowlist secret

配置片段

{
  env: { vars: { DEEPINFRA_API_KEY: "<your-deepinfra-api-key>" } }, // pragma: allowlist secret
  agents: {
    defaults: {
      model: { primary: "deepinfra/deepseek-ai/DeepSeek-V4-Flash" },
    },
  },
}

支持的功能面

聊天、图像生成和视频生成会在配置 DEEPINFRA_API_KEY 后,从 https://api.deepinfra.com/v1/openai/models?sort_by=openclaw&filter=with_meta 实时刷新其模型目录。实时发现会扩展可选模型列表;每个功能面的默认模型仍保持为下方的静态值。其他功能面使用静态目录,直到它们迁移到同一实时目录。

功能面 默认模型 OpenClaw 配置/工具
聊天 / 模型提供商 deepseek-ai/DeepSeek-V4-Flash(实时目录会增加更多聊天模型) agents.defaults.model
图像生成/编辑 black-forest-labs/FLUX-1-schnell(实时目录会增加更多 image-gen 模型) image_generate, agents.defaults.mediaModels.image
媒体理解 moonshotai/Kimi-K2.5 用于图像 入站图像理解
语音转文本 openai/whisper-large-v3-turbo 入站音频转录
文本转语音 hexgrad/Kokoro-82M tts.provider: "deepinfra"
视频生成 Pixverse/Pixverse-T2V(实时目录会增加更多 video-gen 模型) video_generate, agents.defaults.mediaModels.video
记忆嵌入 BAAI/bge-m3 memory.search.provider: "deepinfra"

DeepInfra 还公开了重排序、分类、目标检测和其他原生模型类型。OpenClaw 目前尚未为这些类别提供提供商契约,因此此插件不会注册它们。

可用模型

配置密钥后,OpenClaw 会动态发现 DeepInfra 模型。使用 /models deepinfra 或 openclaw models list --provider deepinfra 查看当前列表。

deepinfra.com 上的任何模型都可以使用 deepinfra/ 前缀:

deepinfra/deepseek-ai/DeepSeek-V4-Flash
deepinfra/deepseek-ai/DeepSeek-V4-Pro
deepinfra/zai-org/GLM-5.2
deepinfra/stepfun-ai/Step-3.7-Flash
deepinfra/moonshotai/Kimi-K2.7-Code
deepinfra/moonshotai/Kimi-K2.6
deepinfra/nvidia/NVIDIA-Nemotron-3-Ultra-550B-A55B
deepinfra/nvidia/NVIDIA-Nemotron-3-Super-120B-A12B
...and many more

价格估算

聊天发现会保留来自 DeepInfra 的 agent projection 的模型成员资格、顺序、标签和限制。价格则单独来自匿名原生 /models/list 目录。插件会将每 token 美分转换为每百万 token 美元,仅应用一次宣传的数字折扣,并使用原生缓存输入比率。这两个请求共享现有的五分钟实时目录缓存,并且仅在已配置的聊天发现中并发运行。图像和视频发现不会请求聊天价格。

由价格说明文字、非空价格表或计划折扣到期限定的价格计划仍保持未知;OpenClaw 不会猜测上下文层级或解析促销日期。声明的通用缓存写入速率也仍不受支持,因为其数字语义未记录在案。明确的 5 分钟/1 小时保留期和 priority/flex 费率是单独的契约,不包含在标准估算中。参见 DeepInfra 的 提示缓存 和 缓存保留 文档。

缺失或不受支持的单个价格计划会使用必需的运行时零成本占位符,其含义是未知,而不是已验证的免费计费。元数据或原生价格请求失败会将聊天发现标记为不可用,并保留相同提供商配置和凭据下最后一次成功的目录。即使价格不可用,成功的空模型响应也会清除已发现的聊天模型。实时发现不会添加响应中缺失的捆绑模型。没有凭据时,捆绑目录仍可在不获取的情况下保持可用。显式配置的模型和成本仍具有权威性;引导设置不会固定提供商价格。

插件的公共 buildDeepInfraProvider API 保留其建议性默认值:当发现失败时,它会保留捆绑选项并使用未知价格估算。OpenClaw 注册的目录钩子显式选择 discoveryMode: "strict",以便失败或空的获取结果原样到达共享发布所有者。

托管发布使用相同的原生解析器。对于不受支持或缺失的价格计划,它会保留元数据而不产生成本,保留声明的零价格,并在原生数据源验证失败时保持之前的托管目录完整不变。现有的 托管目录刷新和 Gateway 重启生命周期 保持不变。

备注

  • 模型引用格式为 deepinfra/<provider>/<model>(例如 deepinfra/Qwen/Qwen3-Max)。
  • 默认聊天模型:deepinfra/deepseek-ai/DeepSeek-V4-Flash
  • 基础 URL:https://api.deepinfra.com/v1/openai
  • 视频生成使用 OpenAI 兼容的异步端点 https://api.deepinfra.com/v1/openai/videos(先提交,然后轮询)。已配置的 baseUrl 会生效。openclaw doctor --fix 会自动将 api.deepinfra.com 上遗留的 nativeBaseUrl 或 /v1/inference 值迁移到 baseUrl;自定义原生端点已弃用,并会显示 doctor 提示,需要手动配置 OpenAI 兼容的 baseUrl。当 baseUrl 仍指向已弃用的 /v1/inference 接口时,视频生成会在发送任何请求之前以可操作的错误失败。

本页原文 Markdown:在 AtomGit 查看·内容源自开源项目 cl/openclaw