Llama Cpp 插件参考
用于 GGUF 聊天和嵌入的托管及外部 llama.cpp 服务器。
分发¶
- 包:
@openclaw/llama-cpp-provider - 安装途径:npm 或 ClawHub:
clawhub:@openclaw/llama-cpp-provider
接口面¶
- 提供商:
llama-cpp - 契约:
embeddingProviders
默认文本模型¶
在交互式设置期间,OpenClaw 会安装一个固定版本且经过验证的 llama-server,并提供 Gemma 4 E4B IT Q4_K_M 作为约 5.0 GB 的下载。该模型选项要求总内存至少为 16 GiB。在内存较小的机器上,仍会检测到已有的缓存模型。
若要使用其他模型,请将 params.modelPath 设置为任意自定义 GGUF。自定义模型不受捆绑下载内存要求限制。对于低于该要求的机器,你也可以通过 Ollama 或 LM Studio 运行更小的模型,或选择云提供商。
相关文档¶
本页原文 Markdown:在 AtomGit 查看·内容源自开源项目 cl/openclaw