Skip to content

本地Gamma大模型部署:OpenClaw+Hermes零Token双智能体

2026年4月26日

本地Gamma大模型部署:OpenClaw+Hermes零Token双智能体

免费、全程本地闭环、无云端扣费、数据不外泄。本地部署 Gamma(Gemma4)大模型,对接 OpenClaw + Hermes 双智能体,实现零 Token、零订阅费的私有化 AI 系统。

整体架构

Ollama(模型调度层)

Gamma 本地大模型(推理层)

OpenClaw / Hermes(双智能体应用层)

所有推理、对话、任务执行全部在本地设备完成,不调用任何外网接口。

四大核心亮点

亮点说明
零 Token 消耗无云端 API、无计费、无次数限制
数据本地闭环所有数据仅存本机,杜绝隐私泄露
双智能体协同OpenClau 自动化 + Hermes 自进化
低设备门槛普通笔记本即可部署轻量模型

组件释义

组件说明
Gamma(Gemma4)谷歌开源轻量化大模型,适配个人设备
Ollama本地大模型管理工具,自带 OpenAI 兼容接口
OpenClaw自动化执行、浏览器操控、工作流智能体
Hermes持续记忆、自我迭代、技能沉淀智能体

硬件适配标准

模型版本最低硬件要求适用设备
Gamma4 4B(q4_0)内存 8G / 显存 3G轻薄本、Macbook
Gamma4 26B(q4_0)内存 16G / 显存 18GRTX4090、Mac Studio
Gamma4 31B(q4_0)内存 32G / 显存 20G专业算力设备

推荐:普通用户首选 Gamma4 4B 量化版,兼顾速度与稳定性。

软件依赖安装

安装 Ollama

Mac / Linux

bash
curl -fsSL https://ollama.com/install.sh | sh

Windows(管理员 PowerShell)

powershell
winget install Ollama.Ollama

验证安装:

bash
ollama --version

安装 OpenClaw

前置要求:Node.js 18+

bash
npm install -g openclaw
openclaw --version

安装 Hermes

bash
curl -fssl https://raw.githubusercontent.com/nousresearch/hermes-agent/main/scripts/install.sh | bash
hermes --version

部署 Gamma 大模型

一键拉取模型

低配设备(推荐)

bash
ollama run gemma4:4b-q4_0

高配设备

bash
ollama run gemma4:26b-q4_0

验证模型

  1. 终端直接对话,模型正常回复即部署成功
  2. 浏览器访问:http://localhost:11434/v1/models

Ollama 默认端口 11434,提供标准 OpenAI 兼容接口。

OpenClaw 对接本地 Gamma

生成配置文件

bash
openclaw init

修改配置文件

Mac/Linux~/.openclaw/openclaw.jsonWindowsC:\Users\用户名\.openclaw\openclaw.json

json
{
  "models": {
    "providers": {
      "ollama": {
        "baseUrl": "http://127.0.0.1:11434/v1",
        "apiKey": "local-empty-key",
        "models": [
          {
            "id": "gemma4:4b-q4_0",
            "name": "Gamma 4B Local",
            "type": "text"
          }
        ]
      }
    },
    "default": "ollama/gemma4:4b-q4_0"
  }
}

启动验证

bash
openclaw models list
openclaw start

所有自动化任务、文本处理、工具调用全部走本地模型,零 Token 消耗。

Hermes 对接本地 Gamma

编辑配置文件

bash
cd ~/.hermes

编辑 config.yaml

yaml
model:
  provider: "ollama"
  api_base: "http://127.0.0.1:11434/v1"
  api_key: "local-empty-key"
  model_name: "gemma4:4b-q4_0"
  temperature: 0.7
  max_tokens: 2048

启动服务

bash
hermes start

Hermes 所有记忆推理、任务学习、对话响应全部基于本地模型,无外网计费请求。

双智能体协同逻辑

智能体职责
OpenClaw执行外部自动化、工具调用、工作流任务
Hermes承接思维推理、记忆沉淀、策略优化
Gamma 模型统一底层推理内核,双智能体共享

零 Token 有效性核验

  1. 无云端密钥:全程未填写任何官方 API Key
  2. 断网可用:设备断开外网,双智能体依旧正常工作
  3. 无计费记录:无平台账单、无 Token 消耗日志

常见报错与解决方案

显存/内存不足

  • 降级使用 4b-q4_0 轻量模型
  • 关闭显卡后台程序、浏览器释放资源

智能体连接失败

bash
ollama ps  # 检查模型是否运行
  • 检查 11434 端口是否被占用或防火墙拦截
  • 核对配置文件内模型名称、接口地址

推理响应慢

  • 升级 q8_0 高精度量化模型(设备允许)
  • 开启显卡 CUDA 硬件加速
  • 关闭模型冗余日志

方案拓展

拓展方向说明
本地 RAG接入 Chroma/Qdrant 向量库,实现私有文档问答
多模型切换Ollama 安装通义千问、Llama、Mistral 等
工作流闭环结合 OpenClaw 实现本地 AI 写作、数据处理
局域网调用配置端口映射,手机/平板调用本机 AI 服务

总结

在 AI 工具普遍按 Token 计费的环境下,本地私有化部署是最具性价比的选择。

通过本方案,你可以搭建:

  • ✅ 零 Token、零订阅、永久免费的私有大模型
  • ✅ 可自动化执行任务的 OpenClaw 智能体
  • ✅ 可自我学习迭代的 Hermes 进化智能体

完全脱离第三方平台限制,数据私有、成本归零、能力自主。


关键词:Gamma大模型, 本地部署AI, OpenClaw配置, Hermes智能体, 零Token成本, Ollama私有化, Gemma4部署

不要孤军奋战啦!

加入微信群一起学习交流 AI

与大神一起使用 OpenClaw、Hermes、Claude Code、Seedance 2.0、GPT-Image-2 等

微信公众号

扫码关注微信公众号
私信 "加群",将自动获取微信群二维码

探索 AI 世界,掌握智能未来