Appearance
AI Agent 入门必知 12 条:工具会换,底层逻辑不变
工具会换,底层的东西不会换。Token 怎么算、上下文怎么管、规则怎么写、技能怎么搭——这 12 条知识搞明白了,换什么 Agent 工具都不慌。不管用 Claude Code 还是 OpenClaw,入门先看这篇。
说起来这个系列,最初是因为很多人开始接触 AI Agent,我就想把自己踩的坑写出来,没想到写着写着就写了二十多篇。
(更没想到的是,这个系列还没写完,已经有声音在说 OpenClaw 要被 Hermes 取代了……)
但说实话,工具会换,底层的东西不会换。Token 怎么算、上下文怎么管、规则怎么写、技能怎么搭,这些搞明白了,换什么工具都不慌。
今天的目标很明确,看完这一篇,Agent 入门这件事就算交代清楚了。
第一部分:Agent 是啥?
知识点 1:Agent ≠ 聊天机器人
你把活儿丢给它,它自己去干。能改文件,能跑命令,不用你手动一步步操作。一杯茶一包烟,看着它干就完了。
这跟以前用网页版 AI 聊天完全不一样。以前是你问它"你觉得我该怎么办",它给你一堆建议,然后你自己动手。Agent 是直接帮你动手。
知识点 2:Agent 由三样东西组成
模型、工具、上下文。
- 模型是脑子,决定它聪不聪明
- 工具是手,决定它能干什么操作
- 上下文是脑子里装的东西,决定它怎么想、怎么做
模型你选不了太多,就那么几家的几个档位。工具大家能装的也差不多。真正拉开差距的,是上下文。
第二部分:上下文管理
知识点 3:上下文 ≠ 聊天记录
很多人觉得上下文就是聊天记录。不全是。
记忆、知识库、规则、技能,这些东西名字不同,但本质上都是一样的——塞进 Agent 的窗口之后,都会影响它怎么想、怎么做。所以统称叫上下文。
知识点 4:上下文有窗口限制
不管你塞多少东西进去,Agent 每次只能"看到"固定大小的窗口。
| 模型 | 上下文窗口 |
|---|---|
| Claude | 200K tokens |
| GPT-4 | 128K tokens |
| 国产模型 | 32-128K tokens |
窗口满了会怎样?早期的内容会被"挤出"窗口,Agent 就忘了。
知识点 5:Token 是钱,也是空间
Token 怎么算?输入 token + 输出 token = 总消耗。
输入越便宜,输出越贵。同样是输出 1K tokens,价格可能是输入的 3-5 倍。
长对话时定期用 /compact 或 /summarize 让 Agent 总结当前进度,释放上下文空间,避免 token 爆炸。
第三部分:规则与技能
知识点 6:规则文件不是越长越好
规则文件建议控制在 2000 字以内,超过这个长度 Agent 反而会遗漏关键指令。
优先级高的规则放最前面。
知识点 7:技能 = 能力包
Skill 就是给 Agent 装上工具的方式。装上什么,它就会什么。
常用 Skills 分类:
- 文件操作:读写、搜索、整理
- 网页浏览:搜索、抓取、摘要
- 代码执行:运行、调试、部署
- 数据分析:图表、报表、洞察
知识点 8:MCP 是标准化协议
MCP(Model Context Protocol) 是标准化工具接入协议。支持 MCP 的工具可以无缝接入支持 MCP 的 Agent。
这意味着你不用给每个 Agent 单独写工具对接代码了。
第四部分:记忆与成本
知识点 9:记忆分两种
- 短期记忆:当前对话窗口内的内容
- 长期记忆:持久化存储的内容(文件、数据库)
不同 Agent 的记忆机制不同。有的用 Markdown 文件,有的用 SQLite,有的用向量数据库。
知识点 10:成本控制是必修课
Agent 不是免费的。每次调用模型都在烧钱。
成本控制三原则:
- 日常对话用便宜模型(DeepSeek、通义千问)
- 复杂推理用强模型(Claude、GPT-4)
- 定期清理无用的 Skill 和记忆
知识点 11:安全边界要设好
Agent 有"手"之后,也能搞破坏。
- 危险命令审批:删除文件、执行 Shell 命令前确认
- 沙箱隔离:限制可操作的目录范围
- 敏感数据保护:API Key 用环境变量管理,不要硬编码
知识点 12:工具只是手段
不管用 Claude Code、OpenClaw、还是 Hermes Agent,核心逻辑是一样的:
上下文管理 → 规则配置 → 技能安装 → 记忆持久化 → 成本控制 → 安全边界
这六步走完,换什么工具都能快速上手。
总结:12 条速查表
| 编号 | 知识点 | 核心要点 |
|---|---|---|
| 1 | Agent ≠ 聊天机器人 | Agent 能动手,不只是动嘴 |
| 2 | 三大组成 | 模型 + 工具 + 上下文 |
| 3 | 上下文 | 记忆、知识库、规则、技能都是上下文 |
| 4 | 窗口限制 | 窗口满了会"挤出"早期内容 |
| 5 | Token 成本 | 输入便宜,输出贵;定期 compact |
| 6 | 规则长度 | 控制在 2000 字以内,优先级高的放前面 |
| 7 | 技能分类 | 文件、网页、代码、数据分析四大类 |
| 8 | MCP 协议 | 标准化工具接入,无缝对接 |
| 9 | 两种记忆 | 短期(窗口)+ 长期(持久化) |
| 10 | 成本控制 | 日常用便宜模型,复杂用强模型 |
| 11 | 安全边界 | 审批 + 沙箱 + 敏感数据保护 |
| 12 | 工具中立 | 六步流程通用,换工具不慌 |
工具会换,底层的东西不会换。这 12 条记住,Agent 入门就算交代清楚了。
