资讯动态

Obsidian+WorkBuddy+Gitee 搭建 AI 知识库实战

发布时间:2026/10/4 8:12:18 来源:尧图企业网站定制
这两年我一直在一堆笔记工具之间反复横跳最后停在了 Obsidian WorkBuddy Gitee 这组组合上配合 AI 能力把个人知识库真正跑通了。先说结论Obsidian 负责让内容沉淀下来WorkBuddy 这类 AI 工作台负责把沉淀下来的笔记重新用起来Gitee 负责让这一切在多个设备之间同步并安全备份。这篇就围绕这个三联组合讲讲我的搭建思路、实操步骤以及踩过的坑。1. 为什么是这三件套组合背后的思路1.1 Obsidian知识库的底座把内容主权握在自己手里个人知识库这件事我试过 Notion、语雀、飞书文档最后回到 Obsidian核心原因就一个本地 Markdown 文件才是真正属于我的内容。在线文档工具最大的问题不是功能而是数据主权。一旦断网、平台调整免费策略、或者你换工具几千条笔记的迁移成本会高到让你放弃整理。Obsidian 的本质是一个建立在本地文件夹上的 Markdown 编辑器所有笔记都是纯文本的.md文件用任何一个文本编辑器都能打开。这意味着你的知识库永远不会被某个平台锁死。另一个让我离不开 Obsidian 的是双向链接和图谱。传统文件夹树是一个笔记只有一个位置而 Obsidian 的[[双链]]让笔记之间可以互相引用最终形成一张知识网络。举个实际场景我写了一篇《Docker 容器网络排查》的笔记里面链接到《Linux 路由表基础》和《Nginx 反向代理日志分析》这三篇笔记分散在不同的文件夹里但通过双链和反向链接面板它们的关联关系一目了然。图谱视图看起来像星空图实际上它就是你的知识关系网这是文件夹结构完全给不了的东西。还有插件生态。Dataview 可以把笔记变成结构化数据做统计查询Templater 可以批量生成模板Excalidraw 能在笔记里嵌入手绘图稿再加上其他各种社区插件Obsidian 的扩展能力几乎等同于一个可编程的知识管理平台。而且因为它底层是纯文本AI 工具可以轻松读取和修改这意味着它能无缝接入后面要说的 WorkBuddy。1.2 WorkBuddyAI 工作台补上整理这最后一公里知识库最怕什么不是没记录而是记了之后再也不看几千条笔记变成数字垃圾场。我自己就经历过笔记攒了两千多条想找一篇之前写过的《MySQL 索引失效场景》怎么想都想不起关键词最后只能靠全文搜索一个个翻。这就是收藏型知识库的通病——只有存没有理。WorkBuddy 解决的就是这个问题。它是 AI 工作台 / Agent 平台跟单纯的聊天机器人不一样聊天机器人只能跟你对话而 WorkBuddy 这类 Agent 工具能读写本地文件、执行任务、调用外部工具。换句话说我不需要手动去翻开每一篇笔记做摘要、打标签、找关联而是把这些重复劳动交给 AI 处理。WorkBuddy 的核心机制是 Skill技能也就是把固定的工作流封装成可重复调用的 AI 指令。你可以定义一个笔记摘要器技能AI 读取一篇 Markdown 笔记后自动输出摘要、核心观点、行动项你也可以定义一个收件箱整理器技能AI 把散落在 Inbox 里的笔记按内容主题自动归档。这就像是给知识库请了一个不睡觉的图书管理员它帮你完成机械化的整理工作而你只需要做决策和判断。我接触过不少 AI 笔记工具为什么最终选了 WorkBuddy因为它足够开放。它不限定你必须用它的知识库格式而是可以直接挂载本地目录把 Obsidian 的 Markdown 文件当作工作对象。这样知识库的主权依然在我手上AI 只是我的助理而不是另一个把我数据锁定的平台。1.3 Gitee免费、稳定、在国内好用的远程中枢第三步是给知识库找一个远程副本。Gitee 在这个组合里承担三个角色异地备份、版本历史、多端同步通道。有人会问为什么不用 GitHub答案很简单Gitee 在国内访问速度快得多私有仓库免费额度对个人笔记这种量级完全够用而且它的 Git 协议支持完整SSH 推送、WebHook 这些该有的都有。对于个人知识库这种私密数据Gitee 的私有仓库就是最适合的保险柜钥匙在自己手里保险柜放在云上。版本历史是很容易被忽略的价值。用 Git 管理 Obsidian 文件夹后每一篇笔记的修改都有 commit 记录。某天你删掉了一段重要内容或者改坏了某个文件直接git log找到之前版本一条命令就能恢复。这个能力是 Obsidian 官方同步服务按月付费和坚果云等网盘工具都不太好给的。还有一个现实点Obsidian 官方同步是付费的每台设备单独计价。Gitee 的方案是我自己可控的不依赖任何单一厂商的订阅而且它还能顺带让我在本地多一份 Git 仓库的完整副本数据安全冗余更高。2. 从零搭建Obsidian Gitee 初始化手记2.1 Obsidian 装好后先定结构Inbox 驱动的内容流转第一步很简单从 Obsidian 官网下载客户端然后在本地创建一个 Vault仓库这个 Vault 就是一个普通文件夹。但怎么组织 Vault 的内部结构直接决定了知识库后续能不能被 AI 有效管理。我的目录结构采用了一套结合 PARA 思路的简化版KnowledgeBase/ ├── 0_Inbox/ # 收件箱所有未处理的临时笔记、灵感 ├── 1_Projects/ # 正在进行中的项目有明确目标和截止日期 ├── 2_Areas/ # 持续关注的领域比如容器化性能优化 ├── 3_Resources/ # 主题资料、参考资料、读书笔记 ├── 4_Archive/ # 已归档、不再活跃的内容 ├── Templates/ # 笔记模板Templater 插件使用 └── Attachments/ # 图片、PDF 等附件统一存放这套结构的关键是 Inbox 驱动。平时看到好文章、想到一个点子、开会记了几句话随手丢进0_Inbox不需要立即思考它该放哪。隔一段时间我一般周末统一处理或者在 AI 辅助下批量归档。这样设计的好处是降低记录门槛你永远不会因为不知道该放哪个文件夹而放弃记录。Templates 和 Attachments 单独放也很重要。Templates 承载 Templater 插件的模板文件统一管理方便批量更新Attachments 集中放附件是为了配合 Git 和 AI 处理时减少路径混乱。很多人的图最后散落在各个笔记文件夹里仓库越来越臃肿就是一开始没规划好。2.2 Gitee 私有仓库与 SSH 密钥一条命令搞定连接接下来在 Gitee 上创建一个私有仓库。走注册流程进入新建仓库页面仓库名称我一般和 Vault 同名比如knowledge-base可见性选私有其他选项默认即可。这里有个小细节创建时不要勾选初始化仓库也就是不要自动生成 README、 .gitignore否则你本地仓库和远端仓库的历史会不一致首次推送容易报冲突。然后生成 SSH 密钥。在终端里执行ssh-keygen -t ed25519 -C your_emailexample.com一路回车密钥默认生成在~/.ssh/id_ed25519和~/.ssh/id_ed25519.pub。选 ed25519 而不是传统的 RSA是因为它更安全且效率更高Gitee 是支持的。然后查看公钥内容cat ~/.ssh/id_ed25519.pub把输出的那一长串内容复制下来进入 Gitee 的设置 - SSH 公钥页面粘贴保存。最后测试连接ssh -T gitgitee.com如果看到类似Hi your_username! Youve successfully authenticated的提示说明 SSH 已经通了。之前有朋友卡在这一步多半是公钥没复制完整或者复制时带了换行符检查一下就好了。2.3 用 Git 管好整座知识库初始化与第一次推送进入 Vault 目录初始化 Git 仓库cd ~/KnowledgeBase git init然后创建一个.gitignore文件排除掉 Obsidian 的临时配置和无关内容。我的.gitignore长这样.obsidian/workspace.json .obsidian/cache .trash/ .DS_Store *.tmp这里说明一下为什么只排除workspace.json而不是整个.obsidian目录workspace.json记录的是窗口布局、打开的文件标签页属于本地个性化状态每次使用都会变化多个设备间同步容易导致界面错乱但.obsidian下的plugins和appearance.json反而是希望同步的这样可以保证插件配置在所有设备上一致。这个细节我踩过坑后面再细说。接下来把当前所有文件加入暂存并做第一次提交git add . git commit -m chore: 初始化知识库然后关联远程仓库并推送git remote add origin gitgitee.com:你的用户名/knowledge-base.git git branch -M master git push -u origin master推送成功后Gitee 仓库里就能看到你的全部笔记了。从这时起你的知识库就有了完整的版本快照改坏了也能随时回滚。3. WorkBuddy 接入实战让 AI 真正上手干活3.1 挂载知识库目录先让 AI 看得见你的笔记WorkBuddy 安装完成后第一步是配置大模型 API。你可以接入大模型的官方 API也可以用它内置的模型通道这里按你自己的情况来。配置好模型之后最关键的一步是给它挂载知识库目录权限。我会把 Vault 目录整体挂载给 WorkBuddy但区分两个区域0_Inbox和3_Resources允许 AI 读写其他目录只读甚至像4_Archive可以直接不给权限。为什么这么设置因为 AI 自动归档是容易出错的它可能把一个项目文件误判到归档区只读权限可以防止这类误操作。而 Inbox 本来就是等待处理的临时区AI 读写风险可控Resources 是资料区允许 AI 补充和修改的容错度也高。挂载完成后可以先做个简单的冒烟测试。让 WorkBuddy 读取一篇公开区的笔记问它这篇笔记的核心论点是什么。如果能准确回答说明 AI 已经能理解你的知识库内容了。这一步是整个组合真正跑起来的前提AI 看不到你的笔记后面所有技能都是空中楼阁。3.2 配置四个常用 Skill摘要、标签、串联、归档WorkBuddy 的 Skill 机制是核心。简单理解Skill 就是一段高度结构化的指令模板AI 收到请求后按模板执行固定流程。下面分享我最常用的四个技能你可以照着配置技能一笔记摘要器作用是快速提炼一篇笔记的精华适合处理长文和会议记录。指令模板可以这样写角色你是资深知识管理助手。 任务阅读指定笔记文件输出结构化摘要。 要求 1. 用3-5句话概括笔记核心内容 2. 列出3条关键观点或结论 3. 提取笔记中的行动项如果有 4. 输出格式核心内容 / 关键观点 / 行动项。 注意只输出结果不要评价笔记质量。这个技能帮我解决了一个切实的痛以前读一篇 PDF 的读书笔记要半小时现在 AI 先给出骨架我再判断哪些部分值得精读。特别是那些存了很多但一直没打开的资料收藏终于能被重新翻出来了。技能二自动标签器作用是给笔记生成标签体系。我一直觉得手工打标签很容易打重、打漏而且每人标准还不一样。模板如下角色你是笔记标签专家。 任务为指定笔记推荐 5 个标签。 要求 1. 标签必须贴合内容实际出现的主题不要泛化 2. 优先复用知识库中已有高频标签Docker、K8s、网络、MySQL、AI、效率工具等 3. 输出格式标签之间用逗号分隔。使用一段时间后要留意AI 在复用已有标签这件事上做得好不好。我的做法是在 Prompt 里维护一份高频标签清单隔一个月更新一次保证标签体系不漂移。技能三笔记串联器这是最有知识网络味道的一个技能。它读取当前笔记在 Vault 里找相关的笔记把它们的链接列出来。模板如下角色你是知识图谱分析师。 任务根据当前笔记内容在知识库中查找相关笔记。 要求 1. 按相关度从高到低返回最多5篇笔记 2. 对每篇笔记说明推荐理由和当前笔记的关联点是什么 3. 输出格式推荐理由 -- 笔记标题。有了这个技能知识库越用越聪明才真正落地。我写新笔记时会让 AI 跑一遍串联器它经常能找出我自己都忘了的一篇旧笔记两个碎片知识就这么连上了。这比 Obsidian 自带的反向链接面板更强因为它不是靠显式[[链接]]而是靠语义理解来找关联。技能四收件箱整理器这是针对0_Inbox的批处理技能。每周或者每天让 AI 扫描 Inbox 目录把笔记按内容主题归入1_Projects、2_Areas、3_Resources。模板如下角色你是知识库归档助手。 任务扫描 0_Inbox 目录下所有未处理的笔记为每篇笔记建议归档位置。 要求 1. 只能归档到 1_Projects、2_Areas、3_Resources 三个目录 2. 如果判断不了保留在 Inbox 并标记待人工确认 3. 输出格式文件名 -- 建议目录 -- 归档理由。这里有个关键点AI 只做建议移动文件的操作由我确认后再执行。很多自动化方案的问题在于全自动一旦规则判断错误会破坏原有的目录结构。AI 归到 80% 是对的剩下的 20% 由人把关这个节奏最舒服。3.3 从问答到再创作AI 开始反哺你的内容当四个技能跑起来之后知识库就不再是单向的存而是开始用了。我通常会直接用 WorkBuddy 做几件事第一是知识库问答。我不再需要记忆每篇笔记的具体内容而是直接问我过去写过哪些关于 MySQL 索引优化的思路AI 检索本地笔记后给出汇总。这本质上是轻量版的 RAG检索增强生成只是底层的知识源不再是网上抓的资料而是我自己的笔记集合答案的个性化和可信度都高得多。第二是周报生成。作为一个经常要总结工作的人以前周末写周报需要翻一周的散记现在让 AI 扫描本周所有新增和修改的笔记按项目进展 / 技术问题 / 学习收获三个维度输出周报草稿我改一改就能用。省下来的时间不是一点半点。第三是写作辅助。我写技术博客时会让 AI 先从知识库里抽取相关笔记生成文章大纲然后再逐段展开。这比从空白页开始写的效率高很多而且因为素材全部来自自己的知识积累写出来的内容风格也更统一。但有一点必须提醒AI 生成的内容一定要人工过一遍。它为知识库写的摘要、生成的标签大概率是对的但它输出的结论可能有自己的脑补成分。知识库是你的资产不是 AI 的试验田校验环节不能省。4. 自动化与多端协同把知识库闭环跑起来4.1 用定时任务把 Git 提交变成肌肉记忆知识库维护最大的敌人是怠惰。一个星期忘了手动git push一旦本地硬盘出问题整个库就没了。我的解法是写一个自动提交脚本配合系统定时任务跑起来。先写脚本sync_kb.sh#!/bin/bash cd ~/KnowledgeBase # 检查是否有远程变更 git pull --rebase origin master # 添加所有改动并提交 git add -A timestamp$(date %Y-%m-%d %H:%M) git commit -m chore: 自动同步知识库 $timestamp || exit 0 # 推送远程 git push origin master脚本逻辑很简单先pull --rebase拉取远端最新内容避免多设备修改造成冲突然后git add -A暂存所有改动提交时如果有内容就提交并推送没有改动则直接退出。定时配置方面Linux/macOS 用 crontabcrontab -e # 每30分钟执行一次 */30 * * * * ~/sync_kb.sh ~/sync_kb.log 21Windows 用户可以用任务计划程序触发器设置为每 30 分钟执行sync_kb.bat文件。这个频率对个人笔记来说足够既不会频繁占用资源也能把数据丢失风险控制在半小时以内。4.2 多设备协同先 Pull 再 Push 的黄金规则当你有两台以上设备比如一台台式机、一台笔记本或者还有一部手机时同步顺序就是生死线。规则只有一条先git pull --rebase再本地修改最后推送。我之前有过一次惨痛经历笔记本上改了笔记但忘了推送台式机这边改了另一个文件就直接 push结果 push 被拒绝。当时图省事用了git push -f强制覆盖结果笔记本上的修改全部丢了。从那以后我的所有同步脚本里都默认带--rebase而且永远不强制推送。手机上我一般只用 Gitee 的 App 或者移动端网页查看笔记做只读使用。临时有了想法优先用手机备忘录记回到电脑再整理进 Obsidian。为什么不在手机上直接改因为移动端 Git 操作体验不好而且容易在网络不稳定时产生半截提交反而增加冲突概率。如果你确实需要在手机上编辑建议用支持 Git 的文件管理类的 App操作时注意先 pull 再 push。4.3 备份底线Gitee 不是保险箱的全部虽然 Gitee 解决了远程备份的问题但必须清醒认识到这只是备份体系的一部分。Gitee 的服务器可能故障、账号也可能出问题你的知识库真正的安全底线应该遵循 3-2-1 备份原则——3 份数据、2 种存储介质、1 份异地副本。落到这个组合里我的备份现状是本地 Obsidian 文件夹是主副本Gitee 远程仓库是异地副本然后我还会每隔一两个月打包一次 Vault 目录传到另一个网盘。虽然和坚果云、阿里云盘这类工具相比不够实时但作为兜底策略已经够了。你要是更严谨一点可以再加一个定期任务每月用tar压缩整个 Vault存到移动硬盘然后手动上传到云端。数据安全永远是宁可过度备份不要裸奔。还有一类内容要特别处理包含密码、身份证号、公司敏感信息的笔记。这些我正常情况下不会放进走 Git 同步的 Vault而是单独用一个本地加密目录保存。原因很简单Gitee 虽然是私有仓库但你在任何云端存敏感信息的风险都是存在的没必要为了便利把核心秘密放在第三方服务器上。5. 实操中的坑与排查速查表5.1 常见问题与解决思路下面是这半年多实操中我遇到过的典型问题整理成速查表按现象 / 原因 / 解法排列现象原因解法git push提示Permission denied (publickey)SSH 公钥未添加到 Gitee 或密钥失效重新执行cat ~/.ssh/id_ed25519.pub把公钥完整复制到 Gitee 的 SSH 公钥设置页再ssh -T gitgitee.com测试git pull报本地改动会被覆盖本地和远端同时修改了同一个文件先git stash暂存本地改动pull 后再git stash pop手动处理冲突Obsidian 界面布局频繁错乱.obsidian/workspace.json被同步到多设备在.gitignore里加入.obsidian/workspace.json该文件只保留本地Gitee 推送失败提示文件体积超限仓库存在大图或大压缩包单文件超过 Gitee 限制通常 100MB 左右时用附件目录统一管理大文件不放入 Git 仓库git commit提示nothing to commit脚本里提交信息重复导致退出提交脚本中加入 AI 生成的标签漂移、不统一Skill 的 Prompt 中缺少高频标签清单每个月更新一次 Skill 模板里已有的高频标签列表多设备修改后 push 被拒另一台设备有未推送的提交同步脚本里先git pull --rebase origin master再推送.trash目录大量占用仓库体积Obsidian 删除文件进了回收站.gitignore加入.trash/并定期清理回收站中文文件名在某些 Git 操作显示异常Git 默认对中文路径转义执行git config core.quotepath false提交信息里中文也能正常显示5.2 三条长期使用才换来的独家心得第一小步提交带来的安全感远超想象。以前我也觉得写笔记不需要频繁 commit后来有一次误删了一篇写了三天的调研笔记才发现上一次 commit 已经在两周前回滚之后也丢了大量内容。现在几乎所有操作都会触发自动提交尤其是当 AI 批量归档 Inbox 之前先看一遍git status确认基线状态。养成习惯之后知识库的任何一个变化都能在时间线上追踪改错的成本变得极低。第二Skill 不是配完就一劳永逸要按月迭代。AI 模型在更新你的知识库内容也在变一套 Prompt 跑半年效果一定会下降。我每个月会花十几分钟检查四个核心 Skill 的输出质量比如标签器有没有出现大量未识别标签、整理器的归档正确率有没有下降及时调整清单和指令措辞。这个过程很像给工具做保养投入不大但知识库的空气会始终新鲜。第三先把收件箱 → 人工确认 → 归档这个最小闭环跑通再碰高级自动化。这是我最想强调的一点。很多人一上来就试图让 AI 全自动管理整个知识库结果错位归档、误删内容一堆问题体验很差。我更推荐循序渐进第一阶段只用 Git 自动备份保持手动整理的习惯第二阶段引入 AI 摘要和标签辅助阅读第三阶段才让 AI 参与归档建议并且始终保留人工确认环节。这套组合的威力不在于全自动而在于人和 AI 各管一段——AI 负责速度和检索人负责判断和目标。这半年用下来我个人最大的感受是知识管理终于从健忘症变成了可复利的事情。Obsidian 让我愿意记录WorkBuddy 让我能消化记录Gitee 让我不怕记录丢失。三者的组合并不是什么复杂工程但每一步都是为什么能说清楚的本地优先保证主权AI 工作台负责规模化整理Git 远程仓库提供版本与备份。如果你也想搭一套自己的 AI 知识库建议先照着上面的最小闭环跑起来跑顺了再加自动化你会明显感觉到知识积累开始产生复利效应。

读完文章,也想定制专属网站?

尧图设计师 24 小时内与您沟通定制方案

免费获取报价 →
↑