跳转至

Llama Cpp 插件参考

用于 GGUF 聊天和嵌入的托管及外部 llama.cpp 服务器。

分发

  • 包:@openclaw/llama-cpp-provider
  • 安装途径:npm 或 ClawHub:clawhub:@openclaw/llama-cpp-provider

接口面

  • 提供商:llama-cpp
  • 契约:embeddingProviders

默认文本模型

在交互式设置期间,OpenClaw 会安装一个固定版本且经过验证的 llama-server,并提供 Gemma 4 E4B IT Q4_K_M 作为约 5.0 GB 的下载。该模型选项要求总内存至少为 16 GiB。在内存较小的机器上,仍会检测到已有的缓存模型。

若要使用其他模型,请将 params.modelPath 设置为任意自定义 GGUF。自定义模型不受捆绑下载内存要求限制。对于低于该要求的机器,你也可以通过 Ollama 或 LM Studio 运行更小的模型,或选择云提供商。

本页原文 Markdown:在 AtomGit 查看·内容源自开源项目 cl/openclaw