Appearance
Obsidian知识库正确驾驶方式:脚本替代插件20分钟蒸馏700文件
插件方案配置1天,脚本方案20分钟完成。Obsidian最大优点是阅读Markdown,脚本负责自动化。
karpathy思路
karpathy发布LLM WIKI后,很多人分享怎么搭建Obsidian知识库。
参考:https://gist.github.com/karpathy/442a6bf555914893e9891c11519de94f
整体流程
| 步骤 | 插件 | 功能 |
|---|---|---|
| 1 | Templater | 源文件放入时自动打标签 |
| 2 | Text Generator | 根据标签蒸馏,得到Wiki页面 |
| 3 | Text Generator | Wiki页面放到指定目录 |
| 4 | Dataview | 形成知识地图,动态更新 |
| 5 | copilot | 和个人Wiki对话 |
| 6 | 关系图谱 | 可视化实体关系 |
插件方案遇到的14个问题
| 问题类型 | 具体问题 |
|---|---|
| 模板配置 | 模板文件怎么写、放在哪里、Templater和Text Generator模板是否统一管理 |
| 触发方式 | Templater模板怎么触发、Text Generator怎么触发(自动/右键/命令) |
| LLM配置 | copilot里LLM是否配置正确 |
| 批量处理 | 怎么批量用Text Generator蒸馏、批量的范围、排除哪些目录 |
| 标签处理 | 已有文件有标签头怎么处理、改造怎么批量统一标签头、蒸馏后标签怎么修改 |
| 报错处理 | 插件报错怎么办(text generator、copilot不给出具体错误代码) |
| 界面问题 | 操作界面50%英文、排版紧密、无法选中描述文字、需要较高英文阅读能力 |
结果:这些问题用1天都解决了,但一次性丢700个文件给Text Generator时——没报错,也没出结果。
我到底想要什么?
一个实体关系准确的个人知识库:
- 能够自动或定时更新
- 能够对话
- 能够可视化
问题:一定要用Obsidian插件才能实现吗?
脚本方案功能清单
把需求丢给IDE,20分钟得到全部蒸馏文件:
text
帮我做一个脚本,实现以下功能:
- 初次使用时,记录用户配置信息,后续启动直接作为默认值
- 输入需要蒸馏的区域(默认整个Obsidian目录)
- 输入需要排除的区域(结合上一步得到灵活交集)
- 输入知识库目录(Obsidian目录里新建子目录)
- 配置LLM模型信息(Base URL、API key、模型ID)
- 脚本提示词(默认写好,用户可修改)
- 确认后开始蒸馏,输出到指定目录
- 蒸馏完成后修改标签为已蒸馏
- 显示统计:蒸馏了多少文件、时间效果对比
| 方案 | 时间 | 结果 |
|---|---|---|
| 插件方案 | 1天配置 | 700文件批量蒸馏没结果 |
| 脚本方案 | 20分钟 | 全部蒸馏完成 |
最终工作流
文件丢Obsidian → 自动打标 → 每天运行脚本 → 完成实现全自动。
提问时甚至不需要打开Obsidian,可以在IDE里提问,即时调用联网能力进行后续处理。
结论
| 工具 | 优点 |
|---|---|
| Obsidian | 较好地让人阅读Markdown文件 |
| IDE脚本 | 覆盖Obsidian插件功能,用自然语言沟通解决 |
为什么要用Obsidian插件做这些事情?
用任何一个IDE,都能完全覆盖Obsidian的功能。有任何问题都可以用自然语言去沟通和解决。
Obsidian最大的优点在于:它能较好地让人阅读Markdown文件,同时Markdown文件本身就能被模型阅读。
关键词:Obsidian, 知识库, 蒸馏, 脚本, IDE, karpathy
