Appearance
本地Gamma大模型部署:OpenClaw+Hermes零Token双智能体
免费、全程本地闭环、无云端扣费、数据不外泄。本地部署 Gamma(Gemma4)大模型,对接 OpenClaw + Hermes 双智能体,实现零 Token、零订阅费的私有化 AI 系统。
整体架构
Ollama(模型调度层)
↓
Gamma 本地大模型(推理层)
↓
OpenClaw / Hermes(双智能体应用层)所有推理、对话、任务执行全部在本地设备完成,不调用任何外网接口。
四大核心亮点
| 亮点 | 说明 |
|---|---|
| 零 Token 消耗 | 无云端 API、无计费、无次数限制 |
| 数据本地闭环 | 所有数据仅存本机,杜绝隐私泄露 |
| 双智能体协同 | OpenClau 自动化 + Hermes 自进化 |
| 低设备门槛 | 普通笔记本即可部署轻量模型 |
组件释义
| 组件 | 说明 |
|---|---|
| Gamma(Gemma4) | 谷歌开源轻量化大模型,适配个人设备 |
| Ollama | 本地大模型管理工具,自带 OpenAI 兼容接口 |
| OpenClaw | 自动化执行、浏览器操控、工作流智能体 |
| Hermes | 持续记忆、自我迭代、技能沉淀智能体 |
硬件适配标准
| 模型版本 | 最低硬件要求 | 适用设备 |
|---|---|---|
| Gamma4 4B(q4_0) | 内存 8G / 显存 3G | 轻薄本、Macbook |
| Gamma4 26B(q4_0) | 内存 16G / 显存 18G | RTX4090、Mac Studio |
| Gamma4 31B(q4_0) | 内存 32G / 显存 20G | 专业算力设备 |
推荐:普通用户首选 Gamma4 4B 量化版,兼顾速度与稳定性。
软件依赖安装
安装 Ollama
Mac / Linux
bash
curl -fsSL https://ollama.com/install.sh | shWindows(管理员 PowerShell)
powershell
winget install Ollama.Ollama验证安装:
bash
ollama --version安装 OpenClaw
前置要求:Node.js 18+
bash
npm install -g openclaw
openclaw --version安装 Hermes
bash
curl -fssl https://raw.githubusercontent.com/nousresearch/hermes-agent/main/scripts/install.sh | bash
hermes --version部署 Gamma 大模型
一键拉取模型
低配设备(推荐)
bash
ollama run gemma4:4b-q4_0高配设备
bash
ollama run gemma4:26b-q4_0验证模型
- 终端直接对话,模型正常回复即部署成功
- 浏览器访问:
http://localhost:11434/v1/models
Ollama 默认端口 11434,提供标准 OpenAI 兼容接口。
OpenClaw 对接本地 Gamma
生成配置文件
bash
openclaw init修改配置文件
Mac/Linux:~/.openclaw/openclaw.jsonWindows:C:\Users\用户名\.openclaw\openclaw.json
json
{
"models": {
"providers": {
"ollama": {
"baseUrl": "http://127.0.0.1:11434/v1",
"apiKey": "local-empty-key",
"models": [
{
"id": "gemma4:4b-q4_0",
"name": "Gamma 4B Local",
"type": "text"
}
]
}
},
"default": "ollama/gemma4:4b-q4_0"
}
}启动验证
bash
openclaw models list
openclaw start所有自动化任务、文本处理、工具调用全部走本地模型,零 Token 消耗。
Hermes 对接本地 Gamma
编辑配置文件
bash
cd ~/.hermes编辑 config.yaml:
yaml
model:
provider: "ollama"
api_base: "http://127.0.0.1:11434/v1"
api_key: "local-empty-key"
model_name: "gemma4:4b-q4_0"
temperature: 0.7
max_tokens: 2048启动服务
bash
hermes startHermes 所有记忆推理、任务学习、对话响应全部基于本地模型,无外网计费请求。
双智能体协同逻辑
| 智能体 | 职责 |
|---|---|
| OpenClaw | 执行外部自动化、工具调用、工作流任务 |
| Hermes | 承接思维推理、记忆沉淀、策略优化 |
| Gamma 模型 | 统一底层推理内核,双智能体共享 |
零 Token 有效性核验
- 无云端密钥:全程未填写任何官方 API Key
- 断网可用:设备断开外网,双智能体依旧正常工作
- 无计费记录:无平台账单、无 Token 消耗日志
常见报错与解决方案
显存/内存不足
- 降级使用 4b-q4_0 轻量模型
- 关闭显卡后台程序、浏览器释放资源
智能体连接失败
bash
ollama ps # 检查模型是否运行- 检查 11434 端口是否被占用或防火墙拦截
- 核对配置文件内模型名称、接口地址
推理响应慢
- 升级 q8_0 高精度量化模型(设备允许)
- 开启显卡 CUDA 硬件加速
- 关闭模型冗余日志
方案拓展
| 拓展方向 | 说明 |
|---|---|
| 本地 RAG | 接入 Chroma/Qdrant 向量库,实现私有文档问答 |
| 多模型切换 | Ollama 安装通义千问、Llama、Mistral 等 |
| 工作流闭环 | 结合 OpenClaw 实现本地 AI 写作、数据处理 |
| 局域网调用 | 配置端口映射,手机/平板调用本机 AI 服务 |
总结
在 AI 工具普遍按 Token 计费的环境下,本地私有化部署是最具性价比的选择。
通过本方案,你可以搭建:
- ✅ 零 Token、零订阅、永久免费的私有大模型
- ✅ 可自动化执行任务的 OpenClaw 智能体
- ✅ 可自我学习迭代的 Hermes 进化智能体
完全脱离第三方平台限制,数据私有、成本归零、能力自主。
关键词:Gamma大模型, 本地部署AI, OpenClaw配置, Hermes智能体, 零Token成本, Ollama私有化, Gemma4部署
