跳转至

v2026.8.1: 模型与提供商

聊天和模型页面现在会从 OpenClaw 已有的目录中打开,因此选择模型不再需要等待完整的提供商扫描。实时发现仅在打开模型界面或显式刷新时运行,并在查找失败时保留最后可用列表;/model 可以仅更改当前对话,或有意更新某个智能体或共享默认值。

选定模型后,OpenClaw 会将请求保持在预期的提供商和已授权账户的顺序内,保留流式回复和工具调用的真实顺序与结果,将推理和上下文设置随模型和运行时一起传递,并更清晰地报告计划窗口、Token 用量、上下文压力和估算成本。

查找和选择模型

聊天和模型页面现在会从 OpenClaw 已有的目录开始,当你打开选择器或请求刷新时,受支持的提供商会查找更新的聊天和文本模型。如果查找失败,内置条目和最后可用列表仍可使用。

/model 更改可以只保留在当前对话中,也可以有意应用于某个智能体或共享默认值,持久化更改需要相应的权限。别名和回退机制会将提供商和账户与所选模型绑定在一起。

列表显示 OpenClaw 可以识别的模型,而提供商、账户、区域、端点、套餐、限制和定价则决定你可以使用哪些模型。

来源与完整变更列表

改进

  • 将遗留的 Codex 模型路由迁移到 OpenAI 3c8269c
  • 在 Android 上显示提供商配置的模型 #101912
  • 将 Grok 4.5 添加到捆绑的 xAI 提供商中 #102316
  • 刷新 Qwen、Cohere 和 Mistral 模型目录 #102489
  • 添加当前的 Cohere Command 模型 #102563
  • 为 Muse Spark 1.1 添加捆绑的 Meta Model API 支持 #102873
  • 以规范的提供商包发布 Meta #103070
  • 从主要提供商派生实用模型 #103769
  • 将当前使用的默认值和示例迁移到 GPT-5.6 Sol 和 Luna #104452
  • 减少重复的智能体回合设置延迟 #105220
  • 添加官方的 Baseten Model API 支持 #108708
  • 在 Moonshot 和 Kimi Code 中添加 Kimi K3 支持 #109202
  • 为 macOS 聊天添加按提供商分组的模型和按会话控制 #110339
  • 从实时提供商目录中发现当前的聊天模型 #112412
  • 让提供商目录成为模型兼容性的权威依据 #112542
  • 添加端到端的 Claude Opus 5 支持 #113391
  • 完成 Anthropic 路由中 Claude Opus 5 的全面支持 #113392
  • 围绕当前代际选项精选模型选择器 #113594
  • 完成 Anthropic 路由中 Claude Opus 5 的全面支持 #113633
  • 无需 OpenClaw 发布即可刷新模型目录 #113660
  • 将提供商目录刷新为当前模型阵容 #113681
  • 让热智能体回合启动更快 #113817
  • 添加一流的 Kimi K3 支持 #113909
  • 将模型设置整合到单个模型页面 #115108
  • 自动跟随 xAI 的 OAuth 默认模型 #115617
  • 澄清模型设置并移除重复的活动路由 #116086
  • 添加仅限会话的模型选择并保留回退状态 #119325
  • 添加 Meta Muse Spark 1.2 模型 #120373
  • 添加一流的 Grok 4.6 目录和推理支持 #122762
  • 为 Z.AI Coding Plan 添加 GLM 5.3 支持 #123523
  • 为现有 llama-server 端点添加一流的支持 #125781
  • 统一托管的和现有的 llama.cpp 服务器 #126434
  • feat(models): 添加可配置的模型选择范围 #127813
  • feat(models): 刷新提供商模型和实时发现 #131294
  • 添加对 Alibaba Qwen Token Plan 的一流支持 #94419
  • 将捆绑的 Codex app-server 更新到 0.144.1 #103156
  • 减少热 Gateway 模型的启动延迟 #105552
  • 刷新 Z.AI、Kimi、Moonshot 和 xAI 的目录指南 #109666
  • 在模型设置过程中显示捆绑的提供商图标 #112169
  • 加快按提供商筛选的模型列表速度 #112752
  • 刷新 OpenCode Zen 模型和定价 #113858
  • 添加 Kimi K3 256K 模型选项 #113918
  • 在各提供商目录中保持代码模式层级一致 #115183
  • 记住上次使用的模型,供未来会话使用 #115717
  • 在别名旁边显示完整模型名称 #115789
  • 澄清本地模型设置操作 #116953
  • 减少默认模型列表的内存占用 #117323
  • 澄清 llama.cpp 本地模型设置 #117947
  • 加快已验证的模型设置速度 #118352
  • 从回合启动中移除完整的模型目录构建 #120834
  • 在模型页面中解释实用模型设置 #123277
  • 在各页面间复用 WebUI 模型目录 #124794
  • 避免模型查找期间重复扫描插件 #125090
  • perf(tui): 一次性准备可搜索的选择器行 #127620
  • fix(ui): 为所有提供商认证选项添加品牌图标 #127668
  • perf(cli): 延迟加载 infer 命令域 #128150
  • feat(zai): 添加 GLM-5.3 Flash 模型支持 #130309
  • 将 Step 3.7 Flash 添加到 StepFun 模型目录中 #88082
  • 在静态模型目录中复用准备好的插件元数据 #117288
  • 无需等待推广内容即可显示模型表格 #117322
  • 避免在模型列表期间加载完整的 Ollama 插件 #117465
  • perf(models): 复用投影列表行 #128248

Bug 修复

- 刷新 xAI 模型、推理与服务端工具默认值 [#103260](https://github.com/openclaw/openclaw/pull/103260)
- 使 OpenAI 模型可用性与其生效路由保持一致 [#104685](https://github.com/openclaw/openclaw/pull/104685)
- 强化 OpenAI Codex 发现、退出机制与配额恢复 [#108683](https://github.com/openclaw/openclaw/pull/108683)
- 刷新内置提供商目录并移除已退役模型 [#109410](https://github.com/openclaw/openclaw/pull/109410)
- 将模型别名与覆盖允许列表分离 [#110888](https://github.com/openclaw/openclaw/pull/110888)
- 将当前请求整形应用于未来的 Claude 生成 [#114205](https://github.com/openclaw/openclaw/pull/114205)
- 统一动态模型目录选择 [#114284](https://github.com/openclaw/openclaw/pull/114284)
- 在别名解析过程中保留所选回退提供商 [#114360](https://github.com/openclaw/openclaw/pull/114360)
- 保持 CLI 与 Gateway 之间的模型列表一致 [#114393](https://github.com/openclaw/openclaw/pull/114393)
- 保持代理模型目录与切换的可靠性 [#114760](https://github.com/openclaw/openclaw/pull/114760)
- 提高 gateway-node 与本地模型的可靠性 [#115185](https://github.com/openclaw/openclaw/pull/115185)
- 防止多代理 Gateway 启动停滞 [#116261](https://github.com/openclaw/openclaw/pull/116261)
- 在过期的 Gateway 生命周期中止后停止云回退 [#117168](https://github.com/openclaw/openclaw/pull/117168)
- 让大型成员列表聊天启动不依赖模型目录发现 [#119742](https://github.com/openclaw/openclaw/pull/119742)
- 当模型未返回可用答案时进行回退 [#120148](https://github.com/openclaw/openclaw/pull/120148)
- 保持新聊天推理在各路由上可用 [#120712](https://github.com/openclaw/openclaw/pull/120712)
- 统一代理故障转移错误分类 [#121341](https://github.com/openclaw/openclaw/pull/121341)
- 防止模型目录发现阻塞 Gateway [#122350](https://github.com/openclaw/openclaw/pull/122350)
- 将会话模型选择与响应别名和回退保持分离 [#122910](https://github.com/openclaw/openclaw/pull/122910)
- 在聊天仍可用时恢复模型列表 [#123208](https://github.com/openclaw/openclaw/pull/123208)
- 让 Codex 路由的对话轮次在请求覆盖下正常工作 [#123258](https://github.com/openclaw/openclaw/pull/123258)
- 防止多代理 Gateway 启动时的 CPU 峰值 [#124334](https://github.com/openclaw/openclaw/pull/124334)
- 允许直接推理命令选择代理 [#125143](https://github.com/openclaw/openclaw/pull/125143)
- 在所有位置遵循按代理设置的模型元数据 [#126194](https://github.com/openclaw/openclaw/pull/126194)
- fix(opencode): 按需发现 Zen 和 Go 模型 [#129831](https://github.com/openclaw/openclaw/pull/129831)
- fix(models): 保持原生目录与基于别名的目录一致 [#131677](https://github.com/openclaw/openclaw/pull/131677)
- fix: 允许在不受限制的策略下使用目录外聊天模型 [#132175](https://github.com/openclaw/openclaw/pull/132175)
- 将收集到的后续问题保留在其模型路由上 [1647027](https://github.com/openclaw/openclaw/commit/1647027)
- 在清理接管后保持模型回退正常工作 [#100118](https://github.com/openclaw/openclaw/pull/100118)
- 将 Claude Fable 5 添加到 Claude CLI 模型目录中 [#101453](https://github.com/openclaw/openclaw/pull/101453)
- 在诊断中公开正常模型回退转换 [#102051](https://github.com/openclaw/openclaw/pull/102051)
- 无需重启 Gateway 即可应用热重载的代理模型 [#102305](https://github.com/openclaw/openclaw/pull/102305)
- 忽略大小写差异匹配 Azure 部署映射 ID [#103005](https://github.com/openclaw/openclaw/pull/103005)
- 让替换模式下的模型列表仅限已配置的提供商 [#103103](https://github.com/openclaw/openclaw/pull/103103)
- 在离线发现中恢复当前的 OpenCode Zen 模型 [#103197](https://github.com/openclaw/openclaw/pull/103197)
- 支持托管 ClawRouter Gateway 配置 [#103299](https://github.com/openclaw/openclaw/pull/103299)
- 移除已弃用的 OpenCode Go MiMo 别名 [#103329](https://github.com/openclaw/openclaw/pull/103329)
- 通过 x-ai 别名保留 Grok 行为 [#103340](https://github.com/openclaw/openclaw/pull/103340)
- 允许 Codex 运行时使用 `codex/*` 模型 [#103775](https://github.com/openclaw/openclaw/pull/103775)
- 在日志和模型状态中呈现工具模型叙述失败 [#104770](https://github.com/openclaw/openclaw/pull/104770)
- 限制 Amazon Bedrock 模型发现请求 [#104841](https://github.com/openclaw/openclaw/pull/104841)
- 正确解释账户受限的模型故障 [#104878](https://github.com/openclaw/openclaw/pull/104878)
- 将锁定会话保留在其存储的模型路由上 [#105335](https://github.com/openclaw/openclaw/pull/105335)
- 在 Codex 路由上保留原生思考与快速控制 [#107588](https://github.com/openclaw/openclaw/pull/107588)
- 在回退恢复期间保留较新的模型和认证选择 [#108137](https://github.com/openclaw/openclaw/pull/108137)
- 限制 Amazon Bedrock 控制面请求 [#108756](https://github.com/openclaw/openclaw/pull/108756)
- 限制停滞的 Z.AI 端点探测响应 [#109026](https://github.com/openclaw/openclaw/pull/109026)
- 在模型发现失败后释放 Hugging Face 连接 [#109464](https://github.com/openclaw/openclaw/pull/109464)
- 在临时目录故障期间保留固定模型 [#110364](https://github.com/openclaw/openclaw/pull/110364)
- 添加 OpenCode Zen GPT-5.6 模型发现 [#110405](https://github.com/openclaw/openclaw/pull/110405)
- 在模型状态中报告不可用的 Codex 运行时 [#110447](https://github.com/openclaw/openclaw/pull/110447)
- 为模型故障转移恢复网络错误代码 [#110485](https://github.com/openclaw/openclaw/pull/110485)
- 在模型扫描中报告准确的 OpenRouter 限制 [#110855](https://github.com/openclaw/openclaw/pull/110855)
- 通过代理发现 Vercel AI Gateway 模型 [#111209](https://github.com/openclaw/openclaw/pull/111209)
- 从 Kilocode 聊天目录中隐藏图片输出模型 [#111239](https://github.com/openclaw/openclaw/pull/111239)
- 通过符合条件的 HTTP 代理发现 Chutes 模型 [#111266](https://github.com/openclaw/openclaw/pull/111266)
- 在无配置的嵌入式运行中复用模型发现 [#111423](https://github.com/openclaw/openclaw/pull/111423)
- 在保存配置前拒绝未知文本模型 [#111571](https://github.com/openclaw/openclaw/pull/111571)
- 为冷模型运行时构建提供更长的启动预算 [#111983](https://github.com/openclaw/openclaw/pull/111983)
- 在配置重载期间保持模型目录一致 [#112331](https://github.com/openclaw/openclaw/pull/112331)
- 遵循显式的子代理模型请求 [#112393](https://github.com/openclaw/openclaw/pull/112393)
- 检测固定到旧模型的 Claude CLI 路由 [#113424](https://github.com/openclaw/openclaw/pull/113424)
- 在请求契约支持之前隐藏实时发现的 Claude 模型 [#113757](https://github.com/openclaw/openclaw/pull/113757)
- 修复 Claude 订阅用户的 Anthropic 实时发现 [#113906](https://github.com/openclaw/openclaw/pull/113906)
- 保持并发模型状态 JSON 干净 [#113953](https://github.com/openclaw/openclaw/pull/113953)
- 通过配置的模型策略减少回复启动延迟 [#114117](https://github.com/openclaw/openclaw/pull/114117)
- fix(agents): 在回退链之外重试实时模型切换 [#114214](https://github.com/openclaw/openclaw/pull/114214)
- 在提供商过滤列表中显示刷新的 OpenAI 模型 [#114265](https://github.com/openclaw/openclaw/pull/114265)
- 在原始提供商请求错误时进行回退 [#114457](https://github.com/openclaw/openclaw/pull/114457)
- 在负载下稳定模型元数据和配置恢复 [#114679](https://github.com/openclaw/openclaw/pull/114679)
- 在启动前修复格式错误的生成模型目录 [#114697](https://github.com/openclaw/openclaw/pull/114697)
- 识别本地模型端点并限制回退输出 [#114710](https://github.com/openclaw/openclaw/pull/114710)
- 保持 Infer 提供商检查和选择正常工作 [#115054](https://github.com/openclaw/openclaw/pull/115054)
- 稳定 Infer 模型选择、提供商状态和共享状态访问 [#115170](https://github.com/openclaw/openclaw/pull/115170)
- 在配置的模型列表中显示正确的插件目录元数据 [#115190](https://github.com/openclaw/openclaw/pull/115190)
- 在其输入所有者处规范化模型引用 [#115965](https://github.com/openclaw/openclaw/pull/115965)
- 防止大型模型配置延迟 Gateway 启动 [#116553](https://github.com/openclaw/openclaw/pull/116553)
- 在模型设置后显示本地提供商身份 [#116655](https://github.com/openclaw/openclaw/pull/116655)
- 在缺少模型错误后保持健康的回退模型可用 [#116768](https://github.com/openclaw/openclaw/pull/116768)
- 在浏览视图中恢复运行时发现的模型 [#116857](https://github.com/openclaw/openclaw/pull/116857)
- 在构建大型模型目录时复用插件元数据 [#117131](https://github.com/openclaw/openclaw/pull/117131)
- 在 Codex 预检失败后保持备用运行时可用 [#117256](https://github.com/openclaw/openclaw/pull/117256)
- 在可安全重放的静默失败后使用配置的回退 [#117356](https://github.com/openclaw/openclaw/pull/117356)
- fix(tui): 遵循限制性的代理模型策略 [#117422](https://github.com/openclaw/openclaw/pull/117422)
- 恢复 Cerebras 文档化的静态模型目录 [#117584](https://github.com/openclaw/openclaw/pull/117584)
- 在保留实时发现的同时隐藏已退役的 NVIDIA 模型 [#117620](https://github.com/openclaw/openclaw/pull/117620)
- 防止模型发现超时后仍然挂起 [#117825](https://github.com/openclaw/openclaw/pull/117825)
- 在 Gateway 排空期间保留模型选择 [#118101](https://github.com/openclaw/openclaw/pull/118101)
- 在模型状态期间保留较新的插件元数据 [#119183](https://github.com/openclaw/openclaw/pull/119183)
- 遵循为 ACP 代理配置的模型 [#120046](https://github.com/openclaw/openclaw/pull/120046)
- 刷新 OpenCode Zen 和 Go 模型目录 [#121030](https://github.com/openclaw/openclaw/pull/121030)
- 让精确日期模型固定在 Gateway 启动后仍可执行 [#121119](https://github.com/openclaw/openclaw/pull/121119)
- 迁移已退役的 OpenCode 免费模型引用 [#121125](https://github.com/openclaw/openclaw/pull/121125)
- 在新会话加载时显示准确的默认值 [#121133](https://github.com/openclaw/openclaw/pull/121133)
- 在 CLI 回退到嵌入式模型后提供回复 [#121897](https://github.com/openclaw/openclaw/pull/121897)
- 显示解析后的默认模型及其思考级别 [#122907](https://github.com/openclaw/openclaw/pull/122907)
- 在 agents_list 中显示解析后的模型身份 [#123044](https://github.com/openclaw/openclaw/pull/123044)
- 避免范围限定的模型检查构建完整目录 [#123473](https://github.com/openclaw/openclaw/pull/123473)
- 阻止模型页面代理名册重试风暴 [#123483](https://github.com/openclaw/openclaw/pull/123483)
- 防止截断的已验证 llama.cpp 下载 [#123738](https://github.com/openclaw/openclaw/pull/123738)
- 将推理提供商列表限定到所选代理 [#123884](https://github.com/openclaw/openclaw/pull/123884)
  • 允许较旧的 llama.cpp 提供商为升级修复而加载 #124041
  • 在模型回退期间保持会话状态准确 #124436
  • 在多智能体安装中保留插件补全的智能体选择 #124954
  • 在选择默认模型时拒绝未知的提供商 #125558
  • 在单次插件生成期间保持进行中的模型请求 #125569
  • fix(providers): 为已配置的模型保留已发现的图像支持 #125670
  • 让继承的父模型固定优先于频道默认值 #125880
  • 拒绝不可用的子智能体显式模型请求 #125931
  • 为部分提供商模型配置保留目录能力 #126068
  • 将本地推理准备限定于所选模型 #126196
  • 让多智能体的 infer 命令选择其所属智能体 #126234
  • 为嵌入式尝试保留显式的 Codex 运行时策略 #126259
  • fix(llm-task): 对包含斜杠的模型 ID 信任显式提供商 #126518
  • 当模型元数据来自目录时保留 Codex 选择 #126531
  • refactor(providers): 直接返回准备好的动态模型 #126574
  • fix(codex): 通过现有 Codex 账户运行新可用的模型 #127322
  • 让 Codex 在目录刷新前使用新可用的账户模型 #127394
  • fix(models): 将状态别名解析限定到所选智能体 #127631
  • fix(models): 避免 /models 在重新扫描插件时冻结网关 #127847
  • 在子会话中跳过继承的自动回退覆盖 #128521
  • perf(gateway): 避免首次 models.authStatus 调用从源码重新加载所有插件 #128551
  • fix(workers): 在分派的轮次中解析目录模型 #128553
  • fix: /models 在无关配置编辑后停止工作且无法恢复 #128608
  • fix(tui): 恢复会话设置重置指令 #128731
  • fix(codex): 保持 /codex 模型限定于原生绑定 #128751
  • fix(vercel): 从聊天目录中排除非语言网关模型 #129406
  • fix: 特定于智能体的模型选择反复重新扫描每个插件 #129510
  • fix(huggingface): 遵循可用的提供商能力 #129797
  • fix(cli): 为类似标志的模型选项值保留人类可读的输出 #129911
  • fix(models): 模型浏览在自动插件激活后失败 #130481
  • fix(agents): 为推理能力元数据保留 Codex #130752
  • fix(models): 使 OpenCode 回退与目录生命周期保持一致 #130785
  • fix(models): 在清单更改后保持模型列表一致 #131518
  • fix(config): 接受策划目录之外受支持的模型固定 #131562
  • fix(codex): 在启动和轮次开始时保持原生覆盖生效 #131745
  • fix(agents): 在目录刷新期间保留原生运行时认证 #131931
  • fix(agents): 在刷新过程中保留已准备目录的所有权 #132244
  • fix(anthropic): 将 Claude CLI 能力探测推迟到执行时 #132324
  • fix(fireworks): 阻止不支持的图像到达 GLM 5.2 Fast #132362
  • perf(plugins): 整合提供商发现规划 #133097
  • 识别仅代码的提供商错误以进行模型故障转移 #95729
  • 修复使用非 OpenAI 默认模型组时 Codex ACP 的生成问题 #95852
  • 将生成的多模态模型保留在注册表中 #97858
  • 刷新 NVIDIA 精选模型而不破坏旧配置 #99242
  • 使 Codex 模型发现与客户端版本 0.144.5 对齐 cfaa30a
  • 使截断的回退原因保持为有效的 Unicode #102631
  • 使模型表与宽 Unicode 名称保持对齐 #102819
  • 使 Meta 验证和指导与 Muse Spark 1.1 对齐 #103163
  • 在有界 OpenRouter Fusion 模型 ID 中保留 Unicode #104433
  • 保留使用模型特定图像端点的 Codex 模拟路由 #105444
  • 修复每个智能体模型映射中的旧版 Codex 模型引用 #108369
  • 允许清除智能体模型覆盖 #108734
  • 在读取目录时遵循 OpenRouter 扫描超时 #108972
  • 释放停滞的 GitHub Copilot 目录错误流 #109071
  • fix(plugin-sdk): 为格式错误的提供商目录提供上下文 #109754
  • 安全处理格式错误的提供商目录分页 URL #109986
  • 让状态反映待处理和已完成的实时模型切换 #110474
  • 通过必需的 HTTP 代理发现 Hugging Face 模型 #110924
  • 同步 OpenAI Codex OAuth 目录客户端版本 #110936
  • 在自托管模型发现期间拒绝格式错误的 UTF-8 #111113
  • 嵌套的模型策略通配符遵循命名空间边界 #111350
  • 让 DeepInfra 模型发现使用受信任的 HTTP 代理 #111428
  • 拒绝实时提供商目录中损坏的 UTF-8 #111766
  • 在并发配置重载期间保持新聊天正常工作 #112026
  • 在自动思考重新映射之前报告模型切换 #112352
  • 在 cron 预检期间保留本地提供商错误 #113409
  • 使 Codex OAuth 模型发现与托管的客户端版本对齐 #113615
  • 防止 Meta 目录加载拒绝不支持的输入 #113758
  • 保持空模型列表可被机器读取 #113897
  • 接受模型策略引用中无害的分隔符填充 #114116
  • 使刷新后的模型目录可从 CLI 使用 #114244
  • 识别所有 IPv4 回环模型端点 #114766
  • 拒绝 infer 命令中不完整的模型覆盖 #115225
  • 使已配置的模型行与目录可用性对齐 #115239
  • 在混合目录中保留有效的 LM Studio 模型 #115336
  • fix(status): 最近会话列表解析出错误的智能体模型 #115984
  • 在保存前拒绝格式错误的托管模型目录 #117744
  • 在别名指导中保留显式的提供商和模型引用 #117869
  • 报告准确的嵌入式智能体启动计时阶段 #117879
  • fix(config): ModelCompatSchema 丢弃了 ModelCompatConfig 声明的八个键,而漂移契约无法察觉这一点 #118674
  • 将全局快速模式默认值应用于隐式智能体 #120697
  • fix(acpx): 从 Claude ACP 模型引用中去除 amazon-bedrock 提供商前缀 #121105
  • 在故障转移过程中保留具体的提供商失败原因 #121657
  • 传播提供商目录失败,而不是将其误认为超时 #124288
  • 保留完整的模型回退轨迹 #126048
  • 切换智能体后停止过时的提供商测试 #126750
  • fix(models): --agent 被 models aliases 和 models scan 静默忽略 #126864
  • fix(cli): 模型列表失败时返回 JSON #127726
  • fix(agents): 通过规范解析器解析 PDF 工具模型 #127952
  • fix(agents): 当配置的图像模型条目无法解析时发出警告 #127971
  • fix(cli): 从写入快照解析别名目标 #128223
  • fix(cli): 呈现 models refresh 的 JSON 失败信息 #128981
  • fix(cli): 保持 models --plain 的标准输出不含启动诊断信息 #129037
  • fix(models): 一致地规范化混合别名 #129678
  • fix(agents): 防止所选智能体别名停滞 #129700
  • fix(reply): 使快速中止不作用于提供商运行时 #129704

  • fix(tui): 模型选择器打开后立即关闭“正在加载模型...”提示 #129770

    • fix(models): 避免使用已停用的自动认证探测模型 #129798
    • fix(cli): 在纯文本模式下保留 stdout 上已填充的模型输出 #129871
    • fix(ui): 通过服务器指令重置 /model 默认值 #129895
    • refactor(agents): 通过准备好的所有者解析运行时模型 #130007
    • fix(bedrock): 拒绝无效的 UTF-8 模型发现 #130058
    • fix(agents): 从 session_status 读取已发布的模型目录所有者 #130277
    • refactor(models): 通过单一规范化路径保留目录元数据 #130381
    • fix(cli): 全局模型刷新时拒绝 --agent #130448
    • fix(cli): 全局模型命令拒绝空的代理作用域 #130739
    • fix: 模型选择器刷新发现已配置的代理目录 #131151
    • fix: 冷清单错误隔离了提供商支持的工具 #131601
    • fix(config): 稀疏补丁期间保留编写的模型行 #132080
    • fix(codex): 显式选择的隐藏模型在有限轮次中失败 #132189
    • fix(sessions): 遵循每个代理的模型策略和别名 #132205

    文档

    • 澄清 OpenAI 和 Codex Fast 模式的优先级 #120682
    • docs: 修正数值模型选择指南 #132246
    • 记录滚动的 Anthropic Opus 别名 #113413
    • 修复 OpenRouter 复制粘贴配置示例 #118747
    • 澄清模型切换与缓存权衡 #124889
    • docs: 修正聊天模型选择示例 #132218
提供商账户与登录

OpenClaw 现在将模型请求保持在您配置的提供商账户和凭据顺序内。如果某个账户触发认证或配额冷却,该提供商的下一个授权账户可以接管,而无需更改所选提供商或模型;当该账户恢复后,已保存的偏好设置会重新生效。当未配置显式账户列表时,环境密钥仍然可用。

OAuth 注册仍保留在其开始的设置会话中,失败的凭据写入会以失败形式呈现,而成功登录仅适用于完成认证的模型路由。租户和自定义端点凭据仍保留在其配置时对应的账户和来源上。

新的 GitHub Copilot 设备登录默认将令牌放入 OpenClaw 受保护的本地密钥存储中,并在认证配置文件中保留引用。该存储依赖状态目录权限而非静态加密;现有内联配置文件不会迁移,操作员仍可显式选择先前的纯文本模式。

来源与完整变更列表

改进

  • 在 OpenAI 提供商中支持回环 Codex 代理 #114555
  • 添加 GitHub Enterprise 数据驻留 Copilot 支持 #99221
  • 从 CLI 中移除单个模型认证配置文件 #114407
  • 重用 SQLite 读取器以加快认证配置文件加载 #121358
  • 澄清认证配置文件顺序输出 #112203
  • 刷新 macOS 本地模型和提供商登录翻译 #113493
  • 在运行时淘汰旧版提供商 ID 和密钥标记 #115655

Bug 修复

  • 避免令牌过期后出现错误的 12 小时 OpenAI 冷却 #102479
  • 为 x-ai 提供商别名恢复原生 xAI 路由 #103488
  • 从模型状态 JSON 中移除原始合成凭据 #104734
  • 阻止不受支持的 GitHub Copilot OAuth 域 #105584
  • 恢复 GitHub Copilot 轮次和账户级上下文限制 #106198
  • 恢复 Anthropic Vertex 的服务账户认证 #108350
  • 保持 OAuth 提供商与其所属会话隔离 #108680
  • 呈现凭据保存并强化代理会话和工具 #109622
  • 接受用于 Copilot 的细粒度 GitHub 令牌 #114282
  • 遵循提供商对环境凭据的认证固定 #114944
  • 在无关的重新加载时跳过提供商认证扫描 #117449
  • 切换模型时保留兼容的认证配置文件 #117550
  • 防止未声明的环境凭据接管故障转移 #118458
  • 将 OpenRouter 自定义代理凭据保留在配置的来源上 #118773
  • 回退后停止重试过期的 CLI 认证配置文件 #119843
  • 运行时认证成功后刷新聊天模型可用性 #121193
  • 将配额失败限定到单个认证配置文件 #121278
  • 使 Doctor 在缺少 OAuth 辅助组件时收敛 #123093
  • 在模型请求中遵循已配置的 GitHub Copilot 身份 #127965
  • fix(github-copilot): 设备登录不再留下纯文本令牌 #133033
  • OAuth 续期后刷新模型可用性 #102289
  • 对 GitHub Copilot OAuth 失败详情进行脱敏处理 #102953
  • 当提供商消息包含花括号时保留 OAuth 诊断信息 #103106
  • 为已注销的 Claude CLI 显示可操作的重新认证指南 #103829
  • 当渠道登录切换配置文件时保持 Codex 账户身份 #104706
  • 保持未解析的 API 密钥提供商可见 #106754
  • 停止错误的 Claude CLI 过期警告 #108205
  • 从 GitHub Copilot 嵌入错误中脱敏凭据 #109177
  • 忽略空白的 Google Vertex 项目和位置值 #109515
  • 改进提供商登录、Bedrock 错误和 TUI 渲染 #109740
  • 在 Codex 设备登录期间保持 Telegram 响应 #110580
  • 忽略 Bedrock 的空 AWS 区域覆盖 #110676
  • 对后台凭据发现使用规范的认证配置文件排序 #110678
  • 及时释放停滞的 GitHub Copilot OAuth 错误响应 #112268
  • 对 CLI 支持的代理轮次使用选定的 Claude 配置文件 #112458
  • 防止 Claude CLI 认证配置文件轮次后 Gateway 崩溃 #112550
  • 重试瞬时的 OpenAI 设备码轮询失败 #114094
  • 拒绝不匹配的 Codex 原生主页计费路由 #114719
  • 在 Google 无效密钥错误后继续模型回退 #114887
  • 保持 Claude CLI 登录可刷新,而不是转发过期令牌 #115134
  • 在 SSH 沙箱密钥被拒绝时停止模型回退 #115198
  • 隔离编码代理 Codex 认证 #115611
  • 在外部测试框架中恢复 Copilot 存储配置文件认证 #116555
  • 当代理级 Codex 凭据未导入时引导恢复 #116807
  • 保持模型提供商更改的范围明确且可见 #116829
  • 从不可用的自动认证配置文件覆盖中恢复 #117846
  • 遵循 Google Cloud SDK 凭据和 Vertex 计费项目 #118745
  • 识别媒体提供商的已配置凭据 #118761
  • 防止瞬时超时禁用内联 API 密钥 #119147
  • 为辅助代理保留继承的认证配置文件顺序 #119505
  • fix(ollama): 从传输错误中脱敏回显的凭据 #119537
  • 无需重启 Gateway 即可应用认证顺序更改 #119946
  • Gateway 重启后保持模型可用 #120977
  • 未配置回退模型时保留速率限制重试 #121294
  • 仅计算成功的速率限制配置文件轮换 #121325
  • fix: 继承的认证配置文件冷却写入目标为子存储并静默无效 #122604
  • 使用备份认证配置文件恢复 OpenAI 会话 #123791
  • 保持当前提供商路由上的认证配置文件轮换 #123894
  • fix(auth): 仅重置被成功登录替换的配置文件 #124014
  • 刷新失败后降低 OAuth 配置文件的优先级 #125507
  • 恢复显式 Bash 环境导入,且不更改 exec PATH 探测 #125624

    • 报告实际保存代理配置文件的认证数据库 #126918
    • 显示持久化的认证数据库路径 #126955
    • fix(agents):在终端失败时显示提供商认证指引 #128375
    • fix(auth):在发布失败后恢复运行时配置文件 #129234
    • fix(auth):一旦共享认证存储拥有凭据,便继承它 #130264
    • fix(tui):登录后重新加载认证存储所有权 #130349
    • fix(agents):发布 SecretRef Codex API 密钥路由成功 #130359
    • fix(models):在详细列表中验证原生 CLI 认证 #130749
    • fix(github-copilot):为域感知 OAuth 配置文件恢复用量 #131137
    • 在频道聊天中报告 Claude OAuth 过期及恢复步骤 #131345
    • fix(gateway/ui):记录模型认证不可用原因;仅根据可操作的认证失败限制输入框 #131697
    • fix(auth):在目录刷新后保持可用的 OpenAI 模型可用 #131803
    • fix(ui):模型凭据恢复后聊天仍被阻止 #132179
    • fix(process):使凭据描述符可重新打开 #132573
    • fix(agents):将认证配置文件与运行时模型 ID 分离 #133175
    • 在计费失败后冷却内联提供商 API 密钥 #88709
    • 让 Azure Responses 模型继续使用 Azure 凭据 #93833
    • 修复认证状态和过期的凭据顺序 #98105
    • 为独立本地代理实例化认证配置文件密钥引用 d4ae2bb
    • 为 Chutes OAuth 请求设置 30 秒截止时间 #102026
    • 将 Google Vertex 凭据刷新限制在 30 秒内 #102050
    • 保持 Microsoft Foundry Azure CLI 错误可读 #102604
    • 保持 Microsoft Foundry 连接错误 Unicode 安全 #102605
    • 忽略格式错误的 Microsoft Foundry 端点 #104796
    • 为内联 OAuth 错误显示重新认证提示 #105085
    • 拒绝格式错误的 fallback-skip TTL 值 #107234
    • 限制停滞的 OpenAI 设备代码登录请求 #109494
    • 在 Microsoft Foundry Azure CLI 登录输出中保留 Unicode #109499
    • fix(microsoft-foundry):在 exec 超时时限制 az 子进程生命周期 #110434
    • 防止 OAuth 刷新失败时使用替代凭据 #112957
    • 在 Google 无效密钥错误后继续模型回退 #114825
    • fix(agents):将重试次数与 API 密钥位置分离 (#102938) #115507
    • 让 Telegram Codex 登录代码支持点按复制 #116608
    • 使用官方 Anthropic Vertex 多区域端点 #116757
    • 停止无操作的 OAuth 迁移提示并显示失败原因 #123164
    • 在重启之间保留 Codex QA 登录身份 #126777
    • 将缺少 API 密钥的错误指向 auth 命令 #127011
    • fix(agents):解析 CLI 运行时别名时忽略已存储的认证配置文件顺序 #129165
    • fix(ollama):在所有回环地址上保护本地凭据 #129168
    • fix(auth):拒绝来自冷启动外部提供商的已退役配置文件 #129580
    • fix(ui):切换代理时清除过期的提供商 API 密钥草稿 #129676
    • fix(github-copilot):忽略已配置的账户顺序 #129978
    • fix(ai):要求兼容提供商显式指定端点 #130453
    • fix(auth):在模型尝试过程中保留凭据来源事实 #131220
    • fix(auth):在显式认证顺序下保持 SecretRef 模型可用 #131255
    • 按区域去重 Bedrock Mantle IAM 故障诊断 #81208

    文档

    • docs(start):修正无头凭据交接至 SQLite 认证存储 #131024
    • 在最小 AI 聊天示例中添加 PowerShell 命令 #108567
    • 修复 Chutes API 密钥设置链接 #113545
流式回复与工具调用

OpenClaw 现在可以区分完整的 流式回复 和在中途停止的回复。在受支持的 Responses 路径中,推理、文本、工具输出和可用用量会保持顺序;如果流失败,已经到达的有效工作会被保留,并且 OpenClaw 仅在重放安全时重试或切换到授权的回退。如果没有安全的恢复路径,部分回复会保留在错误上。

工具调用在名称和参数完整之前不会运行,包括大型流式参数以及调用过程中 provider item ID 发生变化的调用。在启用存储的官方端点上,未管理的 OpenAI 原生 Responses 会话可以在第一轮之后仅发送新输入以继续,如果该上游继续状态过期,则使用完整历史恢复。

来源和完整变更列表

改进

  • 添加结构化的 Codex 问题和原生目标控制 #109724
  • 通过 Gateway 审批中转 Claude CLI 原生工具请求 #112918
  • 通过可复用的 WebSocket 加快 OpenAI 智能体轮次 #121687
  • 继续有状态的 OpenAI 原生 SSE 轮次 #122194
  • feat(codex): 将 main 升级到 app-server 0.149.1 #128370
  • 在 CLI 支持的模型上启用能力门控工具 #102835
  • 在轮次设置期间预热 Codex app server #114551
  • 降低 Codex coding-runtime 和 parity 开销 #114574
  • 流式传输 Ollama 原生工具调用生命周期事件 #116809
  • perf(copilot): 避免重复 BYOK 请求体 #131145
  • 将托管的 Codex app-server 更新到 0.146.1 b269e65
  • 将捆绑的 Codex CLI 更新到 0.144.4 #107208

错误修复

  • 接受 Gemini 工具模式中的数字和布尔枚举 #104567
  • 加固 Codex 中止、动态工具模式和结果中间件 #108105
  • 改进 Codex 全自动执行、故障处理和配额状态 #108626
  • 当 Responses item ID 轮换时保留工具参数 #108630
  • 当媒体没有内联负载时保留工具结果文本 #108697
  • 恢复 ClawRouter Perplexity 工具和模型刷新 #108758
  • 将工具调用前言排除在 Chat Completions 回复之外 #109057
  • 将 ACPX Codex 会话迁移到受维护的适配器 #109075
  • 加固 OpenAI 兼容提供方的可靠性和错误处理 #109556
  • 加固 OpenAI、Azure 和 ChatGPT 中的 Responses 流式传输 #109615
  • 防止重复的工具调用 ID 污染会话 #110518
  • 强制有界的 CLI 输入和提供方响应截止时间 #110627
  • 统一 OpenAI Responses 流处理 #114263
  • 恢复 Codex 补丁执行和快速模式优先级 #114907
  • 在调用方取消后停止配对的本地推理 #115624
  • 保留完整的流式 Chat Completions 响应 #115652
  • 保持受压 Codex 轮次隔离且可见 #115893
  • 使 Codex 和 OpenAI 轮次真实地结束 #116012
  • 在 Responses 流中保留完整的终端输出 #116836
  • 修复 llama.cpp 工具、推理和上下文生命周期 #116903
  • 恢复权威的 OpenAI Responses 输出 #116910
  • 恢复可靠的 Gemini 和 Vertex 流式传输及用量统计 #117042
  • 在回复中保留带围栏的工具调用示例 #117089
  • 保留结构化的 OpenAI Chat 响应 #117136
  • 保留 Gemini 签名和提供方故障 #117193
  • 为 CLI 智能体恢复基于 OAuth 的工具 #119166
  • 当运行失败时保留最终流式文本 #119556
  • 在安静的流式间隙后刷新尾部聊天文本 #119566
  • 恢复 Venice Gemini 工具调用继续 #119783
  • 保留安静长时间运行的 Codex 工具的结果 #119835
  • 显示 Claude CLI 无响应故障 #121589
  • 当模型达到输出限制时交付部分回复 #123546
  • 在托管桌面回退后复用 Codex app server #124885
  • 在退役期间回收 Codex app-server 后代进程 #126285
  • 在原生和 ACP 运行中显示 Codex 输入提示 #126387
  • 拒绝格式错误的流式工具调用 #126391
  • fix(agents): 对带有部分输出的不完整模型流重试 #127338
  • fix(gateway): 当智能体运行失败时使流式响应失败 #127662
  • fix(gateway): 恢复 HTTP 子智能体完成公告 [AI-assisted] #128068
  • perf(ai): 在大型工具调用参数组装时保持流式响应 #128166
  • fix(agents): 将工具策略应用于 Anthropic 原生调用 #128805
  • fix(agents): 安静的模型轮次被虚假的“模型无响应”空闲超时中止 (#117884) 0707fcb
  • fix(openai): 协调轮换的终端消息 ID (#122560) 5acfc2d
  • fix(openai-responses): 协调终端工具调用 (#108461) 8c1a55d
  • 一致地重试瞬时网络故障 #101496
  • 显示 OpenAI 拒绝文本而不是空白回复 #102344
  • 为带前缀的 Gemini 2 模型恢复图像工具结果 #102382
  • 更新 app-server 0.143.0 的 Codex harness #102444
  • 识别零参数 XML 工具调用 #103220
  • 在工具调用修复后保留流式答案顺序 #103585
  • 使 Meta 提供方与官方 Model API 对齐 #103680
  • 防止已取消的本地提供方启动泄漏 sidecar #104070
  • 限制并统一序列化工具调用修复 #104100
  • 在流式块块边界处保留 Unicode #104441
  • 修复 GPT-5.6 工具调用和目录兼容性 #104555
  • 为带有未完成工具的 Codex 轮次保留显式中止结果 #104955
  • 在 ChatGPT 重试等待后清理中止监听器 #105519
  • 保留较新的 ChatGPT Responses WebSocket 连接 #105634
  • fix(deepinfra): 将请求策略应用于视频生成请求 #105887
  • 将托管的 Codex app-server 更新到 0.144.3 #106098
  • 重试瞬时的提供方包装 5xx 错误 #106850
  • 清晰报告空代理响应 #107325
  • 恢复大型 Codex app-server 消息 #107369
  • 在图像保存期间保留 Codex 助手消息顺序 #107680
  • 在循环提供方错误时终止 Anthropic 流 #107800
  • 更正 Codex 工具结果故障分类 #107807
  • 拆分嵌入式运行器编排并加固超时恢复 #107900
  • 从受限的 Z.AI GLM 补全中返回可见文本 #108612
  • 恢复 Codex 工具终端轮次并对齐认证路由 #108966
  • fix(agents): 空闲超时停滞的提供方响应体读取 #109067
  • 防止损坏的 Claude CLI 输出管道使 node 主机崩溃 #109794
  • 在瞬时提供方错误后停止已取消回复的重试 #109805
  • 恢复本地 GGUF 资产解析 #110233
  • 拒绝助手错误中的无效 HTTP 状态前缀 #110554
  • 保持重复的 Responses 工具调用可区分 #110956
  • 释放受保护的响应流读取器锁 #111259
  • ChatGPT Responses 遵循服务器的重试延迟回退 #111353
  • 在无效的提供方 TLS 证书上快速失败 #111818
  • 在停滞的 DNS 预检期间限制 Ollama 请求 #111835
  • 在智能体错误或中止后抑制部分助手输出 #113012
  • 在处理器返回后保持流式 OpenAI 兼容请求继续运行 #113514

    • 对已禁用的 OpenAI 兼容 API 路由返回 404 #113609
    • 关闭失败的 Responses 流而不产生虚假完成 #113629
    • 保留 OpenAI Responses 取消 #113801
    • 安全修复被提供方污染的工具名称 #113814
    • 保留 Qwen Token Plan 在直接模型引用中的行为 #113976
    • 统一 OpenAI 兼容请求行为 #114236
    • 遵守每轮 OpenAI 超时和重试限制 #115017
    • 为 Kimi Code K3 启用自动代码模式 #115022
    • 在插件模型重建过程中保留提供方超时 #115102
    • 保留不完整的 OpenAI Responses 流中的部分输出 #115132
    • 在初始化超时时显示 Codex 启动诊断 #115161
    • 将嵌入式智能体截止时间报告为超时 #115319
    • 为配对节点 Ollama 推理强制使用一个超时 #115558
    • 接受 OpenAI SDK 纯文本 Responses 格式 #115594
    • 恢复 llama.cpp 兼容提供方的工具调用 #115598
    • 保持正在推进的远程 Ollama 流存活 #115648
    • 从每个嵌套工具模式中移除不支持的关键字 #115741
    • 保持 OpenAI Responses 替换流一致 #115799
    • fix(gateway): 保留 OpenAI 兼容响应契约 #116354
    • 让一次性 Claude CLI 命令干净退出 #116577
    • fix(runtime): 防止工作区、提供方和流式生命周期泄漏 #116650
    • 执行 llama.cpp 纯文本工具调用 #116736
    • 遵守 Ollama 停止序列和异步 payload 钩子 #116737
    • 拒绝截断的 Bedrock 流并保留音频结果 #116743
    • 显示被阻止的 Gemini prompts 及其用量详情 #116756
    • 保留 Google 流错误、用量和工具签名 #116822
    • 保留 OpenAI Chat 工具调用生命周期 #116922
    • fix(google): 保留流终止符和提供方工具调用标识 #116926
    • 为格式错误的 Codex 流显示清晰的重试指引 #116966
    • 在回复中保留带围栏的工具标记示例 #116971
    • 修复 Bedrock 流完成和 OpenRouter 模型处理 #116998
    • 一致地强制流式 OpenAI 工具参数限制 #117055
    • 在会话结束时清除粘滞的 ChatGPT SSE 回退 #117123
    • 在诊断时间线中报告提供方 HTTP 状态 #117403
    • 干净关闭未读取的 Ollama 错误响应 #117473
    • 在 Gateway 关闭期间保留 OpenAI 流式终止交付 #117505
    • 为 GitHub Copilot 规范化 Claude 工具 ID #117789
    • 为 Codex OAuth 会话保留 WebSocket 传输 #117832
    • fix(agents): 在终止和错误时关闭代理 SSE 主体 #117887
    • 让显式 llama.cpp HTTP 路由保持在其配置的传输上 #118293
    • 返回正确的最终智能体失败而不产生额外延迟 #118331
    • 将失败的 OpenAI 兼容聊天流报告为 API 错误 #118428
    • 恢复在首个响应主体之前停滞的 Gemini 流 #118511
    • 让 llama.cpp 辅助补全保持在本机传输上 #119082
    • 让 Codex 支持的智能体在当前对话中作出反应 #119649
    • 检测截断的直接 Anthropic 流而不破坏代理响应 #120030
    • fix(ollama): 拒绝流式 NDJSON 响应中的无效 UTF-8 #120240
    • 让格式错误的 LLM 流失败,而不是挂起轮次 #120508
    • 支持 Codex app-server 0.147.0 #120594
    • fix: agent.wait 可能在该运行稍后成功结束之前返回错误 #120606
    • 优先遵守显式 OpenAI 服务层级而非 Fast 模式 #120696
    • 拒绝泄漏的 Claude 工具协议输出 #120734
    • fix(agents): 精确替换过期的超时 payload #122036
    • 在观察到 CLI 超时活动后防止重放 #122153
    • 加快流式助手输出 #122206
    • 隐藏跟随 HTTP 原因短语的 HTML 错误页面 #122290
    • 恢复缓存的 OpenAI WebSocket 续传 #122483
    • fix(tool-call-repair): 停止为每个候选 delta 重新解析整个响应 #122513
    • fix(ai): 在 Responses 失败事件规范化过程中保留结构化错误代码 #122579
    • 遵守嵌入式 OpenAI 轮次中选择的传输 #122946
    • 在工具后提供方过载后完成智能体响应 #123005
    • 重试结构化的瞬时网络故障 #123042
    • 保留 OpenAI 终止错误并避免无意义的故障转移 #123151
    • 在卡住会话恢复期间遵守提供方超时 #123877
    • 为失败的 OpenAI 兼容 HTTP 运行返回失败 #124039
    • 为托管轮次使用捆绑的 Codex app-server #124124
    • fix(agents): 当 Google prompt-cache 响应失败时继续未缓存 #124479
    • 保留 OpenAI WebSocket 失败详情和重试行为 #124591
    • 当一个工具名称不受支持时保留有效的 Codex 工具 #124932
    • 防止 Codex 动态工具重复启动审计 #124976
    • fix(cli-runner): 移除禁用恢复提升的默认看门狗设置 (#125045) #125085
    • 在恢复推理后仅交付最终答案 #125149
    • 将本地模型流策略传播到诊断恢复 (#125147) #125388
    • 将 Ollama HTTP 响应报告到诊断 #125834
    • 在取消后停止 Ollama 响应处理 #125961
    • 一致地记录提供方请求接受 #126028
    • fix(agents): 停止主模型失败后回退任务挂起 #126566
    • refactor(process): 监督 Claude 节点调用 #127475
    • fix(codex): 接受有界的上游 prompt 来源 #127730
    • fix(mistral): 将提供方返回的流式模型保留为 responseModel #128066
    • fix(ai): 为 Mistral 和 Ollama 保留工具结果边界空白 #128266
    • fix(ai): 防止 SSE 取消阻塞结果 #128488
    • fix(agents): 在模型验证和系统轮次中拒绝隐藏输出 #128570
    • fix(cli): 规范化回显的二进制工具输出 #128699
    • fix(anthropic): 将 Claude 问题显示为交互式 prompts #128729
    • fix(agents): 停止对 openai-responses 工具调用 ID 进行双重清理 #128764
    • fix(deepseek): 双竖线 DSML 工具调用作为文本交付且从不执行 #128882
    • fix: 防止自定义 Ollama 云模型无限停滞 #129051
    • fix(mistral): 报告提供方失败而不是静默成功 #129256
    • fix(ai): 按提供方所有权强制 Anthropic 流完成 #129291
    • fix(codex): 在 app-server 启动重试之间退避 #129505
    • fix(gateway): 将失败的聊天流报告为错误 #129787
    • fix(ai): 报告中断的本地模型流而不是空成功 #129794
    • fix(inbound-meta): 避免 Anthropic 计费分类 #130298
    • fix(ai): 在相同 ID 续传时替换流式函数名称 #130537
    • fix: 及时释放停滞的已捕获提供方响应 #130804
    • fix(copilot): 让 Gemini 在没有实时发现的情况下继续工作 #131143
  • fix(copilot): 管理 BYOK 响应流生命周期 #131546

    • fix(agents): 在 Claude CLI 回复流式传输时显示 #132002
    • fix: 防止首次 Grok 工具请求停滞 #132475
    • fix: 防止冷启动图像分析在设置期间超时 #133045
    • fix: 防止工具交接后出现重复评论 #133247
    • fix(gateway): 将超时的 HTTP 智能体运行报告为失败 #133275
    • 限制共享 Codex app-server 启动等待 #89442
    • 阻止回退模型重新运行已完成的智能体工作 #92011
    • 使 Claude CLI 最大轮次失败可操作且可安全重试 #94130
    • 在之前的工具使用之后重试临时提供商故障 #97966
    • 保留没有 finish_reason 的完整流式工具调用 #98124
    • 当协议漂移时发出警告而不中断 Codex 投影 #99287
    • 为仅文本的 Anthropic 模型丢弃工具结果图像 #102329
    • 保持截断的提供商错误为有效 Unicode #102496
    • 当 Codex 工具输出被截断时保留表情符号 #102522
    • 保持较长的 Mistral 错误 Unicode 安全 #102539
    • 保持 Codex 监督者错误消息在表情符号周围有效 #102590
    • 保持 Ollama 格式错误流警告 Unicode 安全 #102593
    • 保持截断的 Codex 动态工具输出为有效 Unicode #102622
    • 在截断的 Codex 工具输出中保留完整字符 #104116
    • 遵循显式配置的 OpenAI Completions 传输 #105539
    • 安全地清理 ClawRouter 归属头 #106454
    • 在诊断时间线属性中保留表情符号边界 #106986
    • 使用 Anthropic SDK 的 SSE 解析器 #107460
    • 限制过大的 Ollama 流记录 #107473
    • 在 Codex app-server 失败消息中保留 Unicode #108335
    • 恢复 cron 工具模式的 llama.cpp 兼容性 #108360
    • 在本地提供商启动错误中保留 Unicode #108518
    • 在 Codex 沙箱 HTTP 输出中保留 Unicode #108618
    • 准确报告提供商 JSON 中的无效 UTF-8 #108849
    • 在 Codex app-server 错误尾部保留 Unicode #109013
    • 准确报告提供商完成错误 #109313
    • 在截断的提供商错误中保持 Unicode 完整 #109786
    • 防止流清理错误覆盖取消 #110427
    • 保持 OpenAI 工具调用 ID 截断 Unicode 安全 #110471
    • 停止重试不可重试的 ChatGPT Responses 错误 #110655
    • 拒绝非文本 Codex WebSocket 响应帧 #111138
    • 在提前退出后释放 Ollama 流锁 #111641
    • 在群聊和频道聊天中显示提供商 503 失败 #113656
    • 在发现的模型变体上保留 Gemini 兼容性标志 #114831
    • 在流式工具参数中保留表情符号 #115536
    • 将流式 Chat Completions 内容与完成事件分离 #115718
    • 当工具记录不完整时保留已完成的 Codex 回答 #115849
    • 防止原生 Anthropic 尝试携带拒绝标记 #116433
    • 释放 Amazon Bedrock 流式客户端 #117039
    • 为动态准备的模型恢复 /tools 清单 #119306
    • 将 ACP 重试状态限定在一次逻辑分发内 #120560
    • 接受 TLS 证书云工作器回退事件 #121285
    • 在 Windows 上保留提供商本地服务环境变量覆盖 #122027
    • 统一跨执行通道的 CLI 故障转移策略 #122164
    • 当后端取消抛出异常时保留回复清理 #122252
    • 重试临时 Undici 套接字故障 #122535
    • 恢复被拒绝的 OpenAI WebSocket 续传 #122727
    • 接受 Open Responses URL 中的无头文本文件 #123431
    • 在替换前关闭不健康的 ACP 运行时 #126494
    • fix(cli): 报告确切的 Claude 流失败 #127169
    • fix(gateway): Responses API 返回空白或截断的助手输出 #128295
    • fix(ai): 在托管 openai completions 流中记录提供商返回的模型 #128324
    • fix(gateway): 流式工具调用静默省略助手评论 #128353
    • fix(gateway): 在流式工具快照中保留已完成状态 #128510
    • fix(cli): 在模型运行中转换 HEIC 序列 #128578
    • chore(deps): 在七天冷却期后刷新依赖项 #129187
    • fix(codex): 在聊天中抑制开发中功能警告 #129493
    • fix(google): 保留提供商返回的响应模型 #129606
    • fix(ai): 本地模型工具调用在独立库流中失败 #129664
    • fix(llama-cpp): 为支持回退的聊天模板恢复工具 #129684
    • fix: 当服务器省略 data: 后的空格时,代理模型流丢弃所有事件 #129905
    • fix(codex): 将不支持的服务层级警告排除在聊天之外 #131190
    • fix(codex): 隐藏托管 Code Mode 兼容性警告 #131943
    • fix(agents): 中和 Anthropic 拒绝标记替换 #132556
    • fix(gateway): 随必需工具调用发送最终文本 #133206

文档

- 记录 llama.cpp 自定义端点的 schema 兼容性 [#117120](https://github.com/openclaw/openclaw/pull/117120)

</details>
推理与上下文限制

推理设置 现在在会话恢复或其认证路由重建时,保持附加到所选模型和运行时。原生 Codex 支持 Sol 和 Terra 的 Ultra 以及 Luna 的 Max;嵌入式 OpenClaw 会将 Ultra 映射到提供商支持的最高推理强度,并为委派工作添加指导,这与原生 Codex Ultra 的行为不同。

受支持的 GPT 和 Claude 路由提供更大的上下文选项。常规 GPT-5.5 和 GPT-5.6 运行使用 272,000 Token 预算,并可选择启用 922,000 Token 输入窗口;Control UI 可以为受支持的 Claude 5 CLI 会话选择 200K 或 1M。这些选项仍仅限于支持它们的路由、界面和账户。

压缩 现在使用最新可信的上下文计数,而不是累积的缓存计费或重复的历史记录,并在受支持的 Responses 检查点之间保留工具输出;当存储的检查点被拒绝时,回退到完整历史记录。上下文限制现在按模型配置,Doctor 可以迁移与显式模型条目关联的受支持提供商级设置。

来源与完整变更列表

改进

  • 在会话内保持已发送 Prompt 历史稳定 #102610
  • 减少重复的 Prompt 和工具指令开销 #105095
  • 将百万 Token OpenAI 上下文设为显式可选启用 #112916
  • 整合模型上下文预算 #124665
  • feat(agents):可选的 Claude CLI 上下文窗口(200K/1M) #127951
  • 在 OpenClaw 和 Codex 运行时中添加 GPT-5.6 Ultra #98021
  • 将托管的 Codex app-server 更新到 0.144.6 #110821
  • 减少每轮重复的会话元数据 Token #113616
  • 稳定 Codex 工具 Prompt 并暴露缓存损失 #115238
  • 添加 Gemini 3.7 Flash 及兼容的思考级别 #123366
  • 为捆绑的 Swift 协议客户端添加会话思考级别 0d215c1
  • 在 /model 摘要中显示生效的思考级别 #111709
  • 在历史受限会话中保留 Prompt 缓存复用 #115281
  • 减少重复的 ambient-room Prompt 内容 #119860

缺陷修复

  • fix(agents):尊重账户范围的历史限制,而不是静默忽略它们 (#119326) 3b3372b
  • 防止模型切换和重连后 Apple 聊天思考过期 #103767
  • 串行化聊天模型和推理更改 #106534
  • 防止累积缓存用量膨胀会话上下文 #108323
  • 防止 ACP 会话因不支持的自动思考控制而失败 #108392
  • 更正直接 Anthropic 会话的 Claude 1M 限制 #108751
  • 防止工具密集型会话过早压缩 #110297
  • 为策略路由的 CLI 会话保留上下文 #115284
  • 允许自定义提供商暴露 Max 和 Ultra 推理 #115690
  • 在 Prompt 更新之间保留 Claude CLI 会话上下文 #116292
  • 在回复维护中保留 Ollama 思考 #116963
  • 让运行时上下文聚焦于当前用户请求 #117364
  • 在嵌入式运行中尊重每个代理的上下文限制 #120343
  • 允许 Claude CLI 会话使用订阅认证进行压缩 #120496
  • 防止 Token 计数膨胀导致过早压缩 #120497
  • 在压缩重试之间保留完整的 Responses 历史 #120729
  • 对齐服务器和本地压缩决策 #123397
  • 防止上下文重复计数导致过早压缩 #124267
  • 让工具密集型会话在运行时切换中存活 #125181
  • 应用 Claude CLI 思考并保留热会话 #125528
  • 通过 Codex 保留 GPT-5.6 Max 和 Ultra 选择 #126492
  • 使用真实的 Ollama Cloud 上下文窗口和能力 #126653
  • fix(acp):在会话复用时保留已配置的思考 #128169
  • fix:Responses 会话在达到上下文限制前压缩 #130993
  • fix:保留 ACP 模型切换和回复完成 #132040
  • fix(compaction):为本地聊天后续轮次保留余量 #132190
  • 在重放前限制过大的 Codex 工具输出 #99578
  • 将 GPT-5.6 Sol 默认设置为中等推理 e9c6c15
  • 使用 GitHub Copilot 的实际 Prompt 限制 #103275
  • 允许 Claude CLI 选择自适应思考强度 #103815
  • 在 Android 聊天中显示特定于模型的思考级别 #103893
  • 将提供商级 Token 限制应用于已配置的模型 #105807
  • 持久化 iOS 聊天思考选择 #106287
  • 在 Claude CLI 路由上保留 Fable 5 强度设置 #107636
  • fix(github-copilot):在请求中保留目录思考强度 #107834
  • 使用 Z.AI 文档中说明的思考 payload #108633
  • 尊重 Kimi Code K3 的思考关闭 #109335
  • 在短文件读取中完成 Claude 转录页面 #109431
  • 持久化 Codex 自动压缩计数 #110587
  • 为缺失的 Anthropic 输出 Token 限制设置默认值 #110617
  • 允许 Apple Watch 聊天继承已配置的思考默认值 #111301
  • 尊重特定于提供商的推理强度映射 #112632
  • 在 TUI 中恢复完整的详细程度和流式推理控制 #113782
  • 在实时模型发现期间读取 Anthropic Token 限制 #113784
  • 当可选思考值被拒绝时,ACP 轮次继续 #113935
  • 在中断后保持 Copilot 工具转录完整 #114403
  • 防止隐藏推理期间出现虚假空闲超时 #114997
  • 让自动压缩切分点释放真实上下文 #115309
  • 从过期的 Claude CLI 会话中恢复频道会话 #115513
  • 为 Microsoft Foundry 部署保留原生 GPT 限制 #115542
  • 使用自托管提供商宣传的上下文窗口 #115566
  • 恢复带标签的 Claude CLI 推理传递 #117264
  • 在 /compact 中尊重存储的模型覆盖和缓存 Token #117580
  • fix(bedrock):当推理关闭时,请求尊重模型输出限制 #119155
  • 防止无响应体的 400 错误触发虚假压缩 #119596
  • fix(agent-core):在 Agent Core 交接中保留显式推理关闭 #120020
  • 尊重 Claw Router 模型推理强度元数据 #120631
  • 在 cloud-worker 交接中保留长 Responses 会话 #120803
  • 为受支持的 Ollama Cloud 模型启用原生最大思考 #121074
  • 在 doctor 迁移期间保留 GPT-5 个性设置 #121346
  • 在心跳之间保留 Claude CLI 上下文 #121509
  • 恢复所有 GPT-5.6 Sol 思考级别 #121865
  • 在压缩期间解析已配置的模型别名 #122422
  • 在原生压缩后刷新 Codex 上下文总计 #123478
  • 在发现顺序之间稳定 Prompt 缓存 #123543
  • 在 Codex 路由运行中尊重每个模型的上下文上限 #124735
  • 在 Codex 中恢复 GPT-5.6 推理强度选项 #126182
  • fix(agents):防止通用插槽 ID 导致角色漂移 #128559
  • fix(agents):原生运行忽略所选的 200K 上下文窗口 #128838
  • fix(models):在模型目录之间保留提供商定义的推理级别 #129623
  • fix(agents):让活动的隐藏模型流避免陷入停滞恢复 #130140
  • fix(ai):在 Responses 工具轮次之间稳定运行时上下文 #130166
  • fix(ai):通过 instructions 而非 input[0] 携带 Responses 系统 Prompt #130206
  • fix(failover): 过大的 Groq 请求导致会话停滞,并给出无法使用的速率限制建议 #130275
    • fix(copilot): 防止静态 GPT-5.4 mini 思考失败 #131160
    • fix(anthropic): 重新加载已压缩的 Claude 会话 #131288
    • fix(agents): 显示被拒绝模型请求的 Token 限制 #131990
    • fix: 长会话中 Prompt 缓存失效——聚合工具结果截断会重写已发送的历史 #132017
    • fix: 将 CJK 压缩摘要保持在预算内 #132145
    • fix(codex): 在受支持的 Platform 路由上遵循 thinking off #132276
    • fix: 保持会话思考控件与其模型所有者一致 #132389
    • fix: 保留模型思考策略并修复实时验证 #132431
    • fix(google): 保留 Gemini 原生压缩所有权 #132527
    • fix: 在自定义压缩器超时后保持摘要检查 #132536
    • fix: 在分轮摘要中保留紧凑焦点 #132564
    • fix(compaction): 恢复分轮摘要且不产生重复章节 #132618
    • 遵循 Claude CLI 会话中已配置的上下文限制 #93198
    • 为 OpenCode Go DeepSeek V4 启用最大思考 #99643
    • 防止静默推理轮次导致 Anthropic 会话损坏 #99772
    • 当推理被限制为 off 时保持 Gemini 思考禁用 #101832
    • 在不相关更新期间保留会话思考级别 #102866
    • 无论大小写如何,都匹配规范的推理强度 #102993
    • 在表情符号边界处保持 Claude 回退摘要有效 #104454
    • 通过网关遵循 Z.AI GLM-5.2 的最大思考 #104778
    • 为已知 Mistral 模型强制安全输出限制 #105040
    • fix(extra-params): 防止未定义的自有属性覆盖已解析的 cacheRetention #106069
    • 在 TUI 中显示当前模型和思考级别 #108669
    • 为已发现的 Ollama 模型在状态中保留思考级别 #108789
    • 将 Claude CLI Mythos 5 上下文保持在其回退限制 #110461
    • 从 Z.AI Token 限制错误中恢复 #111744
    • TUI 页脚反映启动时的思考覆盖 #112237
    • 保留 Ollama 云模型的上下文窗口 #112430
    • 让原生 iOS Talk 继承会话思考级别 #112901
    • 默认规范化独立 AI 包转录 #114843
    • fix(agents): 为提供商自前缀引用解析已配置的上下文 Token #116521
    • 拒绝无效的 Chat Completions Token 上限 #116563
    • 为实时发现的 Ollama 模型保留思考级别 #116584
    • 使用 Kilocode 的提供程序上下文限制 #118868
    • 保留 Chutes 服务上下文限制 #119196
    • 在工具结果上下文限制内保留图像 #120808
    • 使 /think 建议与当前模型匹配 #123507
    • 为长 OpenAI 会话 ID 保留 Prompt 缓存边界 #126380
    • fix: 在新会话上显示上下文窗口切换器 #128621
    • fix(apple): 显示被拒绝的聊天会话设置 #128737
    • fix(ai): 恢复仅输入提供商上下文溢出 #129536
    • fix(lmstudio): 保留已保存模型的推理和代码模式 #129675
    • fix(github-copilot): 在 claude-opus-5 上允许 xhigh 和 max 思考级别 #129690
    • fix(tui): 使提供商特定的思考标签可选 #129952
    • fix(deepinfra): 在实时发现期间保留清单推理 #129998
    • fix(ollama): 停止向仅文本模型重放图像 #132106
    • fix(compaction): 在保护提供商失败后恢复回退 #132449
    • fix: 在提供商发现过程中保持 CLI 上下文预算稳定 #132544
    • 当 Prompt 缓存保留无效时发出警告 #94494

文档

- 修正配置和运行时文档,使其与已发布行为一致 [#121324](https://github.com/openclaw/openclaw/pull/121324)
- 修复 Anthropic 提示缓存文档链接 [#114028](https://github.com/openclaw/openclaw/pull/114028)
- 修复 Mistral 推理链接以及文档组件中的审计链接 [#114867](https://github.com/openclaw/openclaw/pull/114867)
- docs(codex): 修正 harness 参考中的 effort 支持与来源信息 [#130882](https://github.com/openclaw/openclaw/pull/130882)

</details>
用量、限制与定价

OpenClaw 现在将订阅计划信息与预估 API 成本分开。聊天可以显示计划窗口、重置时间、积分,以及附加到快照的账户邮箱;而已完成的 iOS 回复可以显示受支持的输入、输出、缓存、成本和上下文压力详情。这些数字是快照或估算值,不是提供商发票;在混合使用 API 密钥和订阅的设置中,账户标签标识的是计划快照,而不是每一次运行。

Control UI 新增了一个 Profile 页面,用于展示 OpenClaw 记录的历史活动,其中 用量 和 Profile 视图按所选时区分组,且由插件发起的模型调用现在会计入聚合总计。OpenClaw 无法重建它从未记录的活动。

受支持的失败或不完整轮次可以保留提供商的 token 和成本数据,而不会被标记为成功。永久性的身份验证、模型、媒体和长窗口配额失败会停止重试,而临时速率限制和可重试的服务器错误会保留其现有的重试或经授权的同一提供商回退行为;Codex 订阅运行不会静默切换到按量付费 API 密钥。

来源与完整变更列表

改进

  • 在聊天上下文弹出层中显示订阅计划限制 #102784
  • 在 Control UI 设置中添加历史活动 Profile #102842
  • 在 iOS 回复下方显示 token、成本和上下文用量 #103471
  • 显示计划用量背后的账户 #106200
  • 让 Profile 聚焦于身份,并将分析移至用量 #115245
  • 使用账户邮箱标注 Codex 用量窗口 #106500
  • 在模型调用遥测中跟踪 Claude Code CLI 轮次 #108304
  • 从托管目录获取模型定价 #114060
  • 使用短生命周期缓存加快重复加载用量页面 #115369
  • 将入门 CLI 身份验证标注为订阅或按用量计费 #122140
  • 使缓存的提供商用量立即返回 #125520

Bug 修复

  • 等待完整的所有代理用量总计 #103998
  • 停止对永久性提供商错误和长配额进行重试 #105258
  • 将插件 LLM 调用纳入用量诊断 #107937
  • 使 Codex 配额故障转移具备模型感知且计费安全 #108254
  • 从临时提供商过载中自动恢复 #109354
  • 强化提供商缓存、重试和溢出恢复 #109796
  • 避免未使用的 Claude CLI 可观测性开销并限制诊断 #110246
  • 限制 Control UI 会话观察者的模型调用 #114052
  • 恢复 Codex 会话的轨迹捕获 #115220
  • 显示真实的 Codex 上下文窗口并简化其弹出层 #121491
  • 在 /status 中恢复 Codex 订阅用量 7eeb109
  • 使提供商用量加载无需等待慢速提供商 e9620fb
  • 限制所有代理的会话用量扫描 #102013
  • 在群聊中显示周期性用量限制错误 #102643
  • 在 DST 期间保持用量和 Profile 的日期分桶正确 #103097
  • 修正 DeepSeek V4 定价和旧版别名元数据 #103241
  • 恢复被 TPM 限制拒绝的 Groq Llama 轮次 #104904
  • 通过一个重试调度器尊重 Retry-After 下限 #105789
  • 保持用量洞察与活动筛选器一致 #105792
  • 在 HTTP 429 响应后重试提供商操作 #106365
  • 防止提供商用量读取在响应头后挂起 #107454
  • 报告真实的 Codex 上下文新鲜度 #107813
  • 在每小时用量指标中计入即时会话 #108160
  • 在用量会话详情中尊重所选时区 #108579
  • 为不完整的 Responses 轮次记录用量和部分输出 #109904
  • 改进 Ollama CJK 用量估算 #110073
  • 当账户限制仍可用时,避免错误的 Codex 订阅用尽消息 #110381
  • 尊重 Anthropic Retry-After 冷却 #111072
  • 在格式错误的响应上保持 Claude 用量刷新稳定 #111088
  • 正确报告 Chutes 缓存读取定价 #111253
  • 使用每个代理的模型注册表为用量定价 #111389
  • 正确统计 OpenRouter 缓存写入 token #111435
  • 显示准确的配额和速率限制警报 #112047
  • 拒绝提供商用量响应中的格式错误 UTF-8 #112081
  • 正确显示当前 MiniMax 配额窗口 #115030
  • 恢复 OpenAI 兼容提供商的 CLI token 用量 #115564
  • 修正 OpenRouter 预算和 Bedrock 缓存核算 #116896
  • 修正托管 OpenAI 聊天的缓存 token 和成本核算 #117043
  • 通过共享流式策略修正托管 Anthropic 缓存核算 #117086
  • 报告完整的 Responses token 用量 #117533
  • 保持多调用 token 总计为累计值 #117930
  • 将已用尽的 xAI 积分分类为计费失败 #118615
  • 将配额暂停应用于会话的实际拥有代理 #120262
  • 修正 LongCat 缓存定价并添加提供商品牌标识 #121369
  • 统一提供商错误处理并防止错误的速率限制匹配 #121817
  • 修正 GPT-5.5 快速模式会话成本 #123152
  • 恢复聊天成本和用量空状态 #123269
  • 保持提供商用量与重新加载的账户配置关联 #124131
  • 恢复 Codex harness 轨迹持久化 #125941
  • 精简恢复所有权和模型元数据 #126751
  • fix(announce): 在统计行中报告未知 token 用量,而不是零 #126976
  • fix(usage): 保留匹配会话 ID 的代理所有权 #128803
  • fix: 恢复已准备提供商凭据的用量 #129220
  • fix(ui): 渐进式渲染模型提供商控件 #130546
  • fix: 在运行用量中包含压缩和分支摘要 token #131115
  • fix: 回复状态显示缺失或过期的上下文估算 #131554
  • fix(usage): 保留重置历史并统一核算 #131667
  • fix: 大型会话历史导致用量仪表板加载缓慢 #132064
  • fix(ui): 仅为会话提供商显示计划用量 #132972
  • 保持所选日期的用量总计不包含无日期历史记录 #89745
  • 重试临时裸 429 提供商错误 #99097
  • fix(agents): 在最终化时保留原生会话核算 beb07f5
  • 在模型调用遥测中保留显式零用量 #100115
  • 防止 Sonnet 5 模型列表在缺少成本数据时崩溃 #102186
  • 忽略提供商格式错误的 Retry-After 日期 #102987
  • 将模型提供商遥测分类为客户端 span #104211
  • 防止用量成本审计停滞 #104823
  • 验证用量页脚固定精度且不破坏高精度 #105297
  • 在缓存刷新期间保持用量页面可用 #105611
  • 安全处理格式错误的 Gemini 配额响应 #106420
  • 丢弃无效的提供商用量重置时间戳 #106421
  • fix(ui): 缓存重建后用量页面仍停留在加载状态 #108270
  • 在 Date 溢出前限制用量历史请求 #110552
  • 安全处理格式错误的 Z.AI 用量响应 #110741
  • 处理格式错误的 DeepSeek 余额响应 #110785

    • 防止格式错误的 Copilot 用量负载破坏刷新 #110795
    • 拒绝损坏的 ClawRouter 用量响应 #111183
    • 在回退通知中保留限流详情 #112702
    • 拒绝不完整的用量日期范围 #113259
    • 为失败的 OpenAI Responses 保留用量 #115175
    • 在目录发布前规范化部分模型成本 #116317
    • 保留 Claude 思考 Token 用量 #116993
    • 修正 Codex app-server Token 用量明细 #117013
    • fix(ios): 先显示最近的用量天数 #117222
    • 遵循为 Claude Sonnet 5 和 Opus 5 配置的价格 #117275
    • 在 UTC 模式下保持待处理用量会话可见 #118004
    • ClawRouter 对格式错误的用量响应显示稳定错误 #119580
    • 在轮次诊断中保留累计 CLI 用量 #120100
    • 保持故障转移消息与失败原因一致 #121717
    • 在所有代理用量总计中包含系统代理成本 #123271
    • 在身份验证失败后保持健康提供商用量可见 #124367
    • 保持提供商用量与刷新后的账户关联 #125709
    • 在超大 Codex 轨迹中保留终端事实 #126050
    • 在目录间隙期间保留已验证的会话上下文限制 #126422
    • 在终端会话中恢复 /usage cost #126668
    • 刷新 Control UI 本地化目录 #126927
    • fix(ui): 保持用量结果与活动筛选器一致 #127720
    • fix(cli): 拒绝格式错误的 usage-cost --days,而不是静默使用默认值 #127978
    • fix(ui): 用量筛选器在选中多个提供商时隐藏会话 #129482
    • fix(kilocode): 付费默认路由器错误地报告零成本 #129546
    • fix(ui): 用量复制操作静默隐藏剪贴板失败 #129562
    • fix(venice): 保留权威模型定价 #129694
    • fix(usage): 防止模型身份冲突 #130307
    • fix(ui): 用量 Shift 点击选择了错误的会话范围 #130375
    • fix(usage): 保留 MiniMax 重置别名顺序 #132897

    文档

    • 解释 Z.AI 速率限制和过载响应 #107940
    • 解释模型用量事件和受支持的用量 API #118483

本页原文 Markdown:在 AtomGit 查看·内容源自开源项目 cl/openclaw