跳转至

Venice AI 提供注重隐私的推理服务:开放模型无日志运行,并对 Claude、GPT、Gemini 和 Grok 提供匿名代理访问。所有端点均与 OpenAI 兼容(/v1)。

隐私模式

模式 行为 模型
私有 Prompt 和响应永远不会被存储或记录。临时性。 GLM、Gemma、Grok、Qwen、DeepSeek、Kimi、Venice Uncensored 等。
匿名 通过 Venice 代理转发,并在转发前剥离元数据。 Claude、GPT 以及部分 Qwen 模型

Warning

匿名模型并非完全私密。Venice 在转发前会剥离元数据,但底层提供商(OpenAI、Anthropic、Google、xAI)仍会处理该请求。如需完全隐私,请使用私有模型。

快速开始

1. 安装插件

openclaw plugins install @openclaw/venice-provider

2. 获取你的 API 密钥

  1. 在 venice.ai 注册
  2. 转到 Settings > API Keys > Create new key
  3. 复制你的 API 密钥(格式:vapi_xxxxxxxxxxxx)

3. 配置 OpenClaw

openclaw onboard --auth-choice venice-api-key

提示输入 API 密钥(或复用已有的 VENICE_API_KEY),列出可用的 Venice 模型,并设置你的默认模型。

export VENICE_API_KEY="vapi_xxxxxxxxxxxx"
openclaw onboard --non-interactive --accept-risk --skip-health \
  --auth-choice venice-api-key \
  --venice-api-key "vapi_xxxxxxxxxxxx"

4. 验证设置

openclaw agent --model venice/zai-org-glm-4.7 --message "Hello, are you working?"

模型选择

  • 默认:venice/zai-org-glm-4.7(私有推理)。
  • 最强匿名选项:venice/claude-opus-5。
openclaw models set venice/zai-org-glm-4.7
openclaw models list --all --provider venice

你也可以运行 openclaw configure,然后选择 Model/auth provider > Venice AI。

Tip

使用场景 模型 理由
通用聊天(默认) zai-org-glm-4.7 Venice 当前的默认特性
整体质量最佳 claude-opus-5 当前推广的匿名 Opus 模型
隐私 + 编程 qwen3-coder-480b-a35b-instruct-turbo 具有大上下文窗口的私有编程模型
快速且便宜 google-gemma-4-31b-it 低成本的推广私有视觉模型
复杂私有任务 deepseek-v3.2 推广的私有推理模型
无审查 venice-uncensored-1-2 当前无审查的 Venice 模型

内置目录(16 个可见模型)

私有模型(10 个)——完全私有,不记录日志
模型 ID 名称 上下文 说明
zai-org-glm-5-2 GLM 5.2 1M 推荐,编程
zai-org-glm-4.7 GLM 4.7 198k 私有推理
venice-uncensored-1-2 Venice Uncensored 1.2 128k 最无审查,视觉
google-gemma-4-31b-it Google Gemma 4 31B Instruct 256k 推荐,视觉
kimi-k2-6 Kimi K2.6 256k 推荐,编程,视觉
deepseek-v3.2 DeepSeek V3.2 160k 推荐,推理
qwen3-235b-a22b-thinking-2507 Qwen3 235B Thinking 128k 默认推理
qwen3-coder-480b-a35b-instruct-turbo Qwen3 Coder 480B Turbo 256k 默认编程
qwen3-vl-235b-a22b Qwen3 VL 235B 128k 默认视觉
grok-4-5 Grok 4.5 500k 推荐,编程,视觉
匿名模型(6 个)——通过 Venice 代理
模型 ID 名称 上下文 说明
qwen-3-7-max Qwen 3.7 Max(通过 Venice) 1M 推荐,编程,视觉
qwen-3-7-plus Qwen 3.7 Plus(通过 Venice) 1M 推荐,编程,视觉
claude-fable-5 Claude Fable 5(通过 Venice) 1M 推荐,编程,视觉
claude-opus-5 Claude Opus 5(通过 Venice) 1M 推荐,编程,视觉
claude-sonnet-4-6 Claude Sonnet 4.6(通过 Venice) 1M 推荐,编程,视觉
openai-gpt-56-sol GPT-5.6 Sol(通过 Venice) 1M 推荐,视觉
已弃用的兼容行(3 个)——从选择器中隐藏
模型 ID 替代模型
zai-org-glm-4.6 zai-org-glm-4.7
google-gemma-3-27b-it google-gemma-4-31b-it

| kimi-k2-5 | kimi-k2-6 |

由 Grok 驱动的 Venice 模型(grok-4-5 及类似型号)会获得与原生 xAI 提供方相同的工具模式兼容性补丁,因为它们共享相同的上游工具调用格式。

模型发现

上述内置目录是受 manifest 支持的种子目录。运行时,OpenClaw 会从 Venice 的 /models API 刷新该目录;如果 API 不可达,则回退到种子目录。/models 端点是公开的(列出模型无需认证),但推理需要有效的 API 密钥。

Venice 可能会继续接受已退役的模型 ID 作为提供方自有的别名。OpenClaw 目录仅公布 /models 返回的规范模型 ID。

DeepSeek V4 重放行为

如果 Venice 提供 DeepSeek V4 模型(如 deepseek-v4-pro 或 deepseek-v4-flash),当 Venice 在助手消息中省略必需的 reasoning_content 重放字段时,OpenClaw 会将其补全,并从请求负载中剥离 thinking/reasoning/reasoning_effort(Venice 会拒绝这些模型上的 DeepSeek 原生 thinking 控制)。此重放修复与原生 DeepSeek 提供方自身的思维控制是分开的。

流式输出与工具支持

功能 支持情况
流式输出 所有模型
函数调用 所有可见的种子模型;实时行遵循 API 元数据
视觉/图像 上面标记为“Vision”的模型
JSON 模式 通过 response_format

定价

Venice 采用基于点数的计费系统。匿名化模型的费用大致相当于直接 API 定价加上少量 Venice 手续费。当前费率请参阅 venice.ai/pricing。

OpenClaw 在模型发现过程中,从 Venice 公开的 GET /api/v1/models 响应中读取实时价格。同一个插件解析器也为托管目录发布器提供数据。已知及新发现的模型均使用 API 的完整价目表(以每百万 Token 的美元计价);种子目录价格则是离线回退方案。当实时价格缺失或无效时,已知模型保留完整的种子目录价目表。没有有效定价的未知模型保留零估值;但这并不表示该模型是免费的。API 明确给出的零费率是有效的。

当 API 提供扩展定价时,只有当提示输入总量超过 context_token_threshold 时,其费率才适用于整个请求。提示输入包括未缓存输入、缓存读取和缓存写入;输出 Token 不参与档位选择。恰好处于阈值的请求仍使用基础费率。基础费率和扩展费率始终来自同一价目表。无效的扩展价目表不会与种子目录或其他来源的价格合并使用。

显式的 models.providers.venice.models[].cost 条目会覆盖目录估算值,包括零值。省略 cost 或设为 {} 则继承目录价目表。部分的统一费率覆盖会继承缺失的基础费率,并移除继承的阶梯档位;显式的 tieredPricing 优先,tieredPricing: [] 则选择统一费率。智能体本地的根 models.json 中的价格保留最高优先级。

在 models.mode: "merge" 模式下,首次接入不会将生成的目录行写入配置,从而避免它们成为价格锚点。重新接入会保留现有的模型条目、别名和模型选择。在 models.mode: "replace" 模式下,接入会保留显式的种子目录行,因为该模式会禁用发现功能。已序列化的既有成本永远不会被自动删除或迁移,即使它们与旧的种子目录条目匹配。启用 merge 模式时,请备份你的配置,并只删除不需要的 cost 字段以恢复目录定价;有意的覆盖项请保留。

发现过程会复用其已有的获取结果和缓存。用量展示不会发起价格请求,运行中的 Gateway 也不会立即采纳上游的每次价格变更。托管目录的更新会在既有的重启边界生效;请参阅 托管模型目录。请仅在源配置中做容量相关的编辑,而不要将生成的模型行复制回源配置:用运行时快照替换整个模型数组可能会把继承的成本固化为显式覆盖项。历史已记录的成本会保留;当前定价只填充缺失的成本或未知价格的零值占位。请参阅 Token 用量与成本。

使用示例

# Default private model
openclaw agent --model venice/zai-org-glm-4.7 --message "Quick health check"

# Claude Opus via Venice (anonymized)
openclaw agent --model venice/claude-opus-5 --message "Summarize this task"

# Uncensored model
openclaw agent --model venice/venice-uncensored-1-2 --message "Draft options"

# Vision model with image
openclaw agent --model venice/qwen3-vl-235b-a22b --message "Review attached image"

# Coding model
openclaw agent --model venice/qwen3-coder-480b-a35b-instruct-turbo --message "Refactor this function"

故障排查

API 密钥无法识别
openclaw models list --provider venice

请确认 API 密钥已配置且以 vapi_ 开头;请勿打印或分享其值。

模型不可用

运行 openclaw models list --all --provider venice 查看当前可用的模型;目录会随着 Venice 新增或退役模型而变化。

连接问题

Venice API 位于 https://api.venice.ai/api/v1。请确认你的网络允许对该主机发起 HTTPS 访问。

Note

更多帮助:故障排查 和 常见问题。

高级配置

配置文件示例
{
  env: { vars: { VENICE_API_KEY: "vapi_..." } },
  agents: { defaults: { model: { primary: "venice/zai-org-glm-4.7" } } },
  models: {
    mode: "merge",
    providers: {
      venice: {
        baseUrl: "https://api.venice.ai/api/v1",
        apiKey: "${VENICE_API_KEY}",
        api: "openai-completions",
        models: [
          {
            id: "zai-org-glm-4.7",
            name: "GLM 4.7",
            reasoning: true,
            input: ["text"],
            contextWindow: 198000,
            maxTokens: 16384,
          },
        ],
      },
    },
  },
}

模型选择

选择提供商、模型引用和故障转移行为。

Venice AI

Venice AI 主页和账户注册。

API 文档

Venice API 参考和开发者文档。

定价

当前 Venice 积分费率和计划。

本页原文 Markdown:在 AtomGit 查看·内容源自开源项目 cl/openclaw