Baseten
Baseten Model APIs 提供托管的、兼容 OpenAI 的前沿模型访问。官方外部插件使用经认证的发现机制,因此 OpenClaw 会跟随你的 Baseten 账户中启用的完整模型集。其离线回退包含下面列出的精选模型。
| 属性 | 值 |
|---|---|
| 提供方 ID | baseten |
| 插件 | 官方外部包(@openclaw/baseten-provider) |
| 认证环境变量 | BASETEN_API_KEY |
| 引导标志 | --auth-choice baseten-api-key |
| 直接 CLI 标志 | --baseten-api-key <key> |
| API | OpenAI 兼容(openai-completions) |
| 基础 URL | https://inference.baseten.co/v1 |
| 默认模型 | baseten/thinkingmachines/inkling |
安装插件¶
安装会自动应用于正在运行的 Gateway;否则将在下次启动时生效。参见 应用更改并检查。
快速开始¶
1. 创建 Baseten 账户和 API 密钥
Baseten 的 Basic 套餐没有月度平台费用。Model API 调用按使用量计费。在 Baseten API 密钥设置 中创建密钥,并在定价页面查看当前费率。
2. 运行引导
引导会保存连接设置,但不会将生成的目录复制到你的配置中。现有的模型行保持不变。如果你使用 models.mode: "replace",引导还会添加内置目录,因为该模式会禁用隐式发现。
3. 验证实时目录
在认证可用时,插件会请求 GET /v1/models,并列出该账户返回的每个模型。没有认证时,它保持离线并使用内置回退。
Inkling¶
Thinking Machines Lab 的 Inkling 是默认模型。在 OpenClaw 中,它支持文本和图像输入、工具调用以及结构化工具 schema。它还支持可配置的推理强度、1.048M token 的上下文窗口,以及最高 32k 的输出 token:
使用 /model baseten/thinkingmachines/inkling -s 切换当前会话。Inkling 接受 off、minimal、low、medium、high、xhigh 和 max 思考级别。OpenClaw 将 off 发送为 reasoning_effort: "none";其他级别保留其名称,包括 max。参见 Baseten 的推理控制。
内置回退目录¶
经认证的实时目录是权威来源。以下行可在发现成功之前让设置和模型选择仍然可用:
| 模型引用 | 输入 | 上下文 | 最大输出 |
|---|---|---|---|
baseten/deepseek-ai/DeepSeek-V4-Pro |
文本 | 262k | 262k |
baseten/moonshotai/Kimi-K2.6 |
文本、图像 | 262k | 262k |
baseten/moonshotai/Kimi-K2.7-Code |
文本、图像 | 262k | 262k |
baseten/nvidia/NVIDIA-Nemotron-3-Ultra-550B-A55B |
文本 | 202k | 202k |
baseten/openai/gpt-oss-120b |
文本 | 128k | 128k |
baseten/thinkingmachines/inkling |
文本、图像 | 1.048M | 32k |
baseten/zai-org/GLM-4.7 |
文本 | 200k | 200k |
baseten/zai-org/GLM-5.2 |
文本 | 524k | 262k |
baseten/zai-org/GLM-5.2-Fast |
文本 | 524k | 262k |
所有内置模型都支持工具调用和推理。OpenClaw 将其思考级别映射到具有原生 reasoning_effort 的模型。Baseten 的可选启用 GLM、Kimi 和 Nemotron 模型默认关闭思考。大多数提供二元的 off/on 控制。GLM 5.2 提供 off、high 和 max。OpenClaw 通过 Baseten 的 chat_template_args.enable_thinking 控制发送这些选择,对于 GLM 5.2,则使用经过验证的顶级 reasoning_effort 参数。
相同的思考控制适用于 agent 轮次和独立模型补全。DeepSeek V4 Pro 回放还会在思考启用时保留推理元数据,并在显式请求 off 时将其移除。
Note
Baseten 可以独立于 OpenClaw 版本添加、移除或更改 Model API。插件会从经认证的 API 刷新模型 ID、上下文限制、输出限制以及输入、缓存输入和输出定价。它会保留模型特定的 OpenClaw 传输策略。
手动配置¶
大多数设置只需要 API 密钥。要显式固定提供方:
{
env: { vars: { BASETEN_API_KEY: "..." } },
agents: {
defaults: {
model: { primary: "baseten/thinkingmachines/inkling" },
},
},
models: {
mode: "merge",
providers: {
baseten: {
baseUrl: "https://inference.baseten.co/v1",
apiKey: "${BASETEN_API_KEY}",
api: "openai-completions",
models: [
{
id: "thinkingmachines/inkling",
name: "Inkling",
reasoning: true,
input: ["text", "image"],
contextWindow: 1048000,
maxTokens: 32000,
},
],
},
},
},
}
Note
如果 Gateway 作为守护进程运行(launchd、systemd、Docker),请确保 BASETEN_API_KEY 对该进程可用。例如,在 ~/.openclaw/.env 中设置,或通过 env.shellEnv 设置。仅在交互式 shell 中导出的密钥,对已在运行的托管服务不可见。
相关¶
选择提供商、模型引用以及故障转移行为。
选择 OpenClaw 推理努力级别。
列出、查看并选择已发现的模型。
身份验证配置和模型选择故障排查。
本页原文 Markdown:在 AtomGit 查看·内容源自开源项目 cl/openclaw