DeepInfra
DeepInfra 通过单个 OpenAI 兼容端点和 API 密钥,将请求路由到热门开源模型和前沿模型。大多数 OpenAI SDK 通过切换 base URL 即可使用它。
安装插件¶
安装会自动应用于正在运行的 Gateway;否则将在下次启动时生效。参见 应用更改并检查。
获取 API 密钥¶
- 登录 deepinfra.com
- 前往 Dashboard / Keys 并生成密钥,或使用自动创建的密钥
CLI 设置¶
或设置环境变量:
配置片段¶
{
env: { vars: { DEEPINFRA_API_KEY: "<your-deepinfra-api-key>" } }, // pragma: allowlist secret
agents: {
defaults: {
model: { primary: "deepinfra/deepseek-ai/DeepSeek-V4-Flash" },
},
},
}
支持的功能面¶
聊天、图像生成和视频生成会在配置 DEEPINFRA_API_KEY 后,从 https://api.deepinfra.com/v1/openai/models?sort_by=openclaw&filter=with_meta 实时刷新其模型目录。实时发现会扩展可选模型列表;每个功能面的默认模型仍保持为下方的静态值。其他功能面使用静态目录,直到它们迁移到同一实时目录。
| 功能面 | 默认模型 | OpenClaw 配置/工具 |
|---|---|---|
| 聊天 / 模型提供商 | deepseek-ai/DeepSeek-V4-Flash(实时目录会增加更多聊天模型) |
agents.defaults.model |
| 图像生成/编辑 | black-forest-labs/FLUX-1-schnell(实时目录会增加更多 image-gen 模型) |
image_generate, agents.defaults.mediaModels.image |
| 媒体理解 | moonshotai/Kimi-K2.5 用于图像 |
入站图像理解 |
| 语音转文本 | openai/whisper-large-v3-turbo |
入站音频转录 |
| 文本转语音 | hexgrad/Kokoro-82M |
tts.provider: "deepinfra" |
| 视频生成 | Pixverse/Pixverse-T2V(实时目录会增加更多 video-gen 模型) |
video_generate, agents.defaults.mediaModels.video |
| 记忆嵌入 | BAAI/bge-m3 |
memory.search.provider: "deepinfra" |
DeepInfra 还公开了重排序、分类、目标检测和其他原生模型类型。OpenClaw 目前尚未为这些类别提供提供商契约,因此此插件不会注册它们。
可用模型¶
配置密钥后,OpenClaw 会动态发现 DeepInfra 模型。使用 /models deepinfra 或 openclaw models list --provider deepinfra 查看当前列表。
deepinfra.com 上的任何模型都可以使用 deepinfra/ 前缀:
deepinfra/deepseek-ai/DeepSeek-V4-Flash
deepinfra/deepseek-ai/DeepSeek-V4-Pro
deepinfra/zai-org/GLM-5.2
deepinfra/stepfun-ai/Step-3.7-Flash
deepinfra/moonshotai/Kimi-K2.7-Code
deepinfra/moonshotai/Kimi-K2.6
deepinfra/nvidia/NVIDIA-Nemotron-3-Ultra-550B-A55B
deepinfra/nvidia/NVIDIA-Nemotron-3-Super-120B-A12B
...and many more
价格估算¶
聊天发现会保留来自 DeepInfra 的 agent projection 的模型成员资格、顺序、标签和限制。价格则单独来自匿名原生 /models/list 目录。插件会将每 token 美分转换为每百万 token 美元,仅应用一次宣传的数字折扣,并使用原生缓存输入比率。这两个请求共享现有的五分钟实时目录缓存,并且仅在已配置的聊天发现中并发运行。图像和视频发现不会请求聊天价格。
由价格说明文字、非空价格表或计划折扣到期限定的价格计划仍保持未知;OpenClaw 不会猜测上下文层级或解析促销日期。声明的通用缓存写入速率也仍不受支持,因为其数字语义未记录在案。明确的 5 分钟/1 小时保留期和 priority/flex 费率是单独的契约,不包含在标准估算中。参见 DeepInfra 的 提示缓存 和 缓存保留 文档。
缺失或不受支持的单个价格计划会使用必需的运行时零成本占位符,其含义是未知,而不是已验证的免费计费。元数据或原生价格请求失败会将聊天发现标记为不可用,并保留相同提供商配置和凭据下最后一次成功的目录。即使价格不可用,成功的空模型响应也会清除已发现的聊天模型。实时发现不会添加响应中缺失的捆绑模型。没有凭据时,捆绑目录仍可在不获取的情况下保持可用。显式配置的模型和成本仍具有权威性;引导设置不会固定提供商价格。
插件的公共 buildDeepInfraProvider API 保留其建议性默认值:当发现失败时,它会保留捆绑选项并使用未知价格估算。OpenClaw 注册的目录钩子显式选择 discoveryMode: "strict",以便失败或空的获取结果原样到达共享发布所有者。
托管发布使用相同的原生解析器。对于不受支持或缺失的价格计划,它会保留元数据而不产生成本,保留声明的零价格,并在原生数据源验证失败时保持之前的托管目录完整不变。现有的 托管目录刷新和 Gateway 重启生命周期 保持不变。
备注¶
- 模型引用格式为
deepinfra/<provider>/<model>(例如deepinfra/Qwen/Qwen3-Max)。 - 默认聊天模型:
deepinfra/deepseek-ai/DeepSeek-V4-Flash - 基础 URL:
https://api.deepinfra.com/v1/openai - 视频生成使用 OpenAI 兼容的异步端点
https://api.deepinfra.com/v1/openai/videos(先提交,然后轮询)。已配置的baseUrl会生效。openclaw doctor --fix会自动将api.deepinfra.com上遗留的nativeBaseUrl或/v1/inference值迁移到baseUrl;自定义原生端点已弃用,并会显示 doctor 提示,需要手动配置 OpenAI 兼容的baseUrl。当baseUrl仍指向已弃用的/v1/inference接口时,视频生成会在发送任何请求之前以可操作的错误失败。
相关¶
本页原文 Markdown:在 AtomGit 查看·内容源自开源项目 cl/openclaw