跳转至

Baseten

Baseten Model APIs 提供托管的、兼容 OpenAI 的前沿模型访问。官方外部插件使用经认证的发现机制,因此 OpenClaw 会跟随你的 Baseten 账户中启用的完整模型集。其离线回退包含下面列出的精选模型。

属性 值
提供方 ID baseten
插件 官方外部包(@openclaw/baseten-provider)
认证环境变量 BASETEN_API_KEY
引导标志 --auth-choice baseten-api-key
直接 CLI 标志 --baseten-api-key <key>
API OpenAI 兼容(openai-completions)
基础 URL https://inference.baseten.co/v1
默认模型 baseten/thinkingmachines/inkling

安装插件

openclaw plugins install @openclaw/baseten-provider

安装会自动应用于正在运行的 Gateway;否则将在下次启动时生效。参见 应用更改并检查。

快速开始

1. 创建 Baseten 账户和 API 密钥

Baseten 的 Basic 套餐没有月度平台费用。Model API 调用按使用量计费。在 Baseten API 密钥设置 中创建密钥,并在定价页面查看当前费率。

2. 运行引导

openclaw onboard --auth-choice baseten-api-key
openclaw onboard --non-interactive --accept-risk --skip-health \
  --auth-choice baseten-api-key \
  --baseten-api-key "$BASETEN_API_KEY"
export BASETEN_API_KEY=...

引导会保存连接设置,但不会将生成的目录复制到你的配置中。现有的模型行保持不变。如果你使用 models.mode: "replace",引导还会添加内置目录,因为该模式会禁用隐式发现。

3. 验证实时目录

openclaw models list --provider baseten

在认证可用时,插件会请求 GET /v1/models,并列出该账户返回的每个模型。没有认证时,它保持离线并使用内置回退。

Inkling

Thinking Machines Lab 的 Inkling 是默认模型。在 OpenClaw 中,它支持文本和图像输入、工具调用以及结构化工具 schema。它还支持可配置的推理强度、1.048M token 的上下文窗口,以及最高 32k 的输出 token:

{
  agents: {
    defaults: {
      model: { primary: "baseten/thinkingmachines/inkling" },
    },
  },
}

使用 /model baseten/thinkingmachines/inkling -s 切换当前会话。Inkling 接受 off、minimal、low、medium、high、xhigh 和 max 思考级别。OpenClaw 将 off 发送为 reasoning_effort: "none";其他级别保留其名称,包括 max。参见 Baseten 的推理控制。

内置回退目录

经认证的实时目录是权威来源。以下行可在发现成功之前让设置和模型选择仍然可用:

模型引用 输入 上下文 最大输出
baseten/deepseek-ai/DeepSeek-V4-Pro 文本 262k 262k
baseten/moonshotai/Kimi-K2.6 文本、图像 262k 262k
baseten/moonshotai/Kimi-K2.7-Code 文本、图像 262k 262k
baseten/nvidia/NVIDIA-Nemotron-3-Ultra-550B-A55B 文本 202k 202k
baseten/openai/gpt-oss-120b 文本 128k 128k
baseten/thinkingmachines/inkling 文本、图像 1.048M 32k
baseten/zai-org/GLM-4.7 文本 200k 200k
baseten/zai-org/GLM-5.2 文本 524k 262k
baseten/zai-org/GLM-5.2-Fast 文本 524k 262k

所有内置模型都支持工具调用和推理。OpenClaw 将其思考级别映射到具有原生 reasoning_effort 的模型。Baseten 的可选启用 GLM、Kimi 和 Nemotron 模型默认关闭思考。大多数提供二元的 off/on 控制。GLM 5.2 提供 off、high 和 max。OpenClaw 通过 Baseten 的 chat_template_args.enable_thinking 控制发送这些选择,对于 GLM 5.2,则使用经过验证的顶级 reasoning_effort 参数。

相同的思考控制适用于 agent 轮次和独立模型补全。DeepSeek V4 Pro 回放还会在思考启用时保留推理元数据,并在显式请求 off 时将其移除。

Note

Baseten 可以独立于 OpenClaw 版本添加、移除或更改 Model API。插件会从经认证的 API 刷新模型 ID、上下文限制、输出限制以及输入、缓存输入和输出定价。它会保留模型特定的 OpenClaw 传输策略。

手动配置

大多数设置只需要 API 密钥。要显式固定提供方:

{
  env: { vars: { BASETEN_API_KEY: "..." } },
  agents: {
    defaults: {
      model: { primary: "baseten/thinkingmachines/inkling" },
    },
  },
  models: {
    mode: "merge",
    providers: {
      baseten: {
        baseUrl: "https://inference.baseten.co/v1",
        apiKey: "${BASETEN_API_KEY}",
        api: "openai-completions",
        models: [
          {
            id: "thinkingmachines/inkling",
            name: "Inkling",
            reasoning: true,
            input: ["text", "image"],
            contextWindow: 1048000,
            maxTokens: 32000,
          },
        ],
      },
    },
  },
}

Note

如果 Gateway 作为守护进程运行(launchd、systemd、Docker),请确保 BASETEN_API_KEY 对该进程可用。例如,在 ~/.openclaw/.env 中设置,或通过 env.shellEnv 设置。仅在交互式 shell 中导出的密钥,对已在运行的托管服务不可见。

模型提供商

选择提供商、模型引用以及故障转移行为。

思考模式

选择 OpenClaw 推理努力级别。

模型 CLI

列出、查看并选择已发现的模型。

模型常见问题解答

身份验证配置和模型选择故障排查。

本页原文 Markdown:在 AtomGit 查看·内容源自开源项目 cl/openclaw