这两年我一直在折腾个人知识库这件事从 Word 文档堆文件夹到印象笔记再到 Notion工具换了不少核心痛点始终没变内容越记越多用的时候根本找不到就算找到了碎片和碎片之间也连不起来。直到我把 Obsidian、WorkBuddy、Gitee 这三样组合到一起才算把记录—整理—沉淀—使用这条链路真正跑通。这篇文章是我整套方案的完整复盘Obsidian 管本地 Markdown 笔记和双链结构WorkBuddy 作为 AI 工作台负责摘要、打标签、批量整理这些最耗时间的环节Gitee 承担版本管理和多端同步。适合正在用或打算从零搭知识库、又想让 AI 真正参与内容加工的同学照着这篇操作基本能搭出一套越用越聪明的个人知识系统。1. 为什么是这三件套组合逻辑与价值拆解1.1 知识库的真正痛点不是存储而是整理与检索很多人以为搭知识库最难的是选软件其实不是。Obsidian、Notion、印象笔记这些工具在存这件事上早就够用了真正的瓶颈在三个地方。第一个是整理。笔记随手记完就丢进某个文件夹过两周再看标题和内容对不上只好再开一篇新的越堆越乱。第二个是关联。碎片信息之间有没有关系得靠人脑去发现和维护手动加双链这件事绝大多数人坚持不了几周就放弃了。第三个是检索。关键词搜索只能命中字面匹配你记得那个讲记忆方法的文章但内容里写的全是间隔重复搜破头也搜不到。这三个痛点单独拿出来Obsidian 能解决关联Gitee 能解决存储安全但整理和语义检索恰恰是 AI 最擅长的事。所以这套方案的思路很直接把人工最贵、最容易偷懒的整理环节交给 WorkBuddy 这类 AI 工作台Obsidian 提供结构化的存储容器Gitee 保证所有改动可追溯、可备份。1.2 Obsidian本地优先、Markdown、双链先说说为什么底座选 Obsidian。最核心的理由是本地优先和纯文本。本地优先意味着你的笔记就是硬盘上的一堆 Markdown 文件不依赖任何云端账号软件哪天打不开、公司电脑不让你装客户端文件照样能用文本编辑器打开。这一点在做了几年知识库之后体会特别深平台可能倒闭纯文本不会。Markdown 纯文本还有个隐藏优势它天生适合被程序处理。WorkBuddy 这类工具读写 Markdown 文件几乎零成本可以直接按文件去总结、改写、提取标签不需要经过任何格式转换。你要是用 Notion 或印象笔记AI 想批量处理只能靠导出再导入链路断裂。双链则是 Obsidian 的灵魂。文件夹是树状结构一个笔记只能属于一个分类但知识本身是网状的。双链允许你在任意两篇笔记之间建立连接最终形成知识图谱。配合 Dataview 这类插件还能按标签、属性自动生成动态列表。这套东西单独用已经很香但加上 AI 自动补链才真正发挥威力。1.3 WorkBuddy把 AI 从聊天窗口搬进知识管线现在大部分人用 AI 还是开个网页聊天窗口复制粘贴问题再复制粘贴回答。这种方式对付零散提问还行用来整理知识库就太痛苦了——每次都要手动把笔记内容贴进去上下文一长就丢输出格式还得自己整理回 Markdown。WorkBuddy 的定位完全不同。它是个能访问本地目录的 AI 工作台装上之后可以直接指定你的 Obsidian 库作为工作目录让它读取文件、生成新笔记、按模板输出结构化内容还能把常用指令封装成 Skill 一键调用。你可以把它理解成能动手干活的 AI 助手而不是只能聊天的问答机器。我用它最频繁的几个场景把 Inbox 里的零散笔记批量改成摘要标签关键结论的结构化笔记扫描全库推荐双链把 Zotero 导入的文献条目提炼成真正能用的知识卡片。这些活如果手工做一周都未必能做完AI 十几分钟就能出初稿我只需要做最后的复核。1.4 Gitee免费远程仓与多端同步第三块拼图是 Gitee。有人问知识库为什么需要 Git因为笔记是逐年累积的资产最怕两件事硬盘坏了以及改坏了回不去。Gitee 免费提供私有仓库把你的 Markdown 笔记推上去每次改动都留历史版本。哪篇笔记被误删了、哪次全局替换把格式搞坏了都能从历史记录里捞回来。这比任何网盘备份都靠谱因为网盘只给你最新版本Git 给你的是完整时间线。多端同步也靠它。我公司电脑、家用电脑、手机三端都在用同一个库Obsidian 装个 Git 插件每隔半小时自动提交推送另一台设备打开时自动拉取效果非常接近实时同步但底层是标准 Git不会出现某些同步盘那种文件被切成碎片的怪问题。2. 环境准备从零搭好三件套2.1 安装 Obsidian 并规划 Vault 结构第一步是下载 Obsidian 客户端。官网下载对应系统的安装包双击装完启动时会让你创建一个 Vault其实就是选一个本地文件夹作为知识库根目录。名字随便起但建议路径别带中文和空格后面接 Git 和 AI 工具时能省掉很多奇怪的坑。Vault 内部结构我强烈建议用 PARA 或者类似的分层方式。PARA 是 Projects、Areas、Resources、Archive 四个顶层目录我实际用下来做了点调整00-Inbox 临时收集未经整理的内容 10-Area 长期关注领域比如学习健康工作方法 20-Project 有明确目标和截止时间的项目 30-Resource 主题资料、文献笔记、技术文档 90-Archive 已完成或不再活跃的内容 _Templates 笔记模板 _Attachments 图片和附件这套结构的关键是 Inbox。所有快速记录的东西先丢进 00-Inbox不做任何分类等系统整理日再处理。这个习惯比装任何插件都重要它保证了你在记录时零阻力整理时又能集中批量处理。Templates 目录放 Templater 插件的模板文件_Attachments 统一放图片方便 Git 忽略和备份。基础插件我建议装这几个Templater、Dataview、Obsidian Git、Zotero Integration后面每一步都会用到。2.2 部署 WorkBuddy 并配置模型服务WorkBuddy 的安装比 Obsidian 还简单官网下载对应平台安装包双击安装首次启动会让你选择工作目录。这里直接把 Obsidian 的 Vault 根目录指定给它这样它就能直接读写你的笔记文件。接下来是配置模型服务。WorkBuddy 本身不带模型需要接入大模型 API国内可直连的选项里我常用 DeepSeek、豆包、通义千问这几家注册后在控制台申请 API Key填进 WorkBuddy 的设置页就行。如果你手头有更顺手的模型只要是兼容 OpenAI 接口格式的一般都能直接填进去。选模型时留意两个参数上下文长度和价格。整理单篇笔记8K 上下文足够但要让它一次扫 50 篇笔记找关联就需要 32K 甚至 128K 的型号价格也会上去。我的习惯是日常小任务用便宜快模型大规模扫描用长上下文模型按任务切换而不是从头到尾只用一种。隐私问题必须提醒一句笔记内容会通过 API 发送到模型服务商涉及账号密码、身份证号、未公开代码这类敏感信息要么别进知识库要么在处理前先单独抽出来。这个底线自己把控别等出了问题再后悔。2.3 Gitee 仓库创建、SSH 密钥配置与许可证选择Gitee 这边先注册账号右上角新建仓库。仓库名建议和 Vault 同名比如 my-knowledge-base其他选项里最需要注意的是仓库是否公开和开源许可证。如果知识库是纯私人的就选私有仓库许可证那一栏直接选不使用因为私有代码不涉及对外授权问题。如果是打算公开分享部分笔记模板或方法论许可证建议选 MIT 或 Apache-2.0两者都很宽松别人引用你的内容时不会被授权条款卡住。Apache-2.0 比 MIT 多了专利授权声明更严谨一点个人用选 MIT 就够写法简单大家也最熟悉。仓库建好之后配 SSH 密钥这样推代码就不用每次输密码。本地打开终端ssh-keygen -t ed25519 -C 你的邮箱一路回车生成密钥然后查看公钥内容cat ~/.ssh/id_ed25519.pub复制输出的整段内容到 Gitee 的设置—安全设置—SSH 公钥里粘贴保存。验证是否配好ssh -T gitgitee.com能返回你的用户名就算通了。这里有个小坑如果之前生成过 RSA 密钥Gitee 页面上可能会有多条公钥弄清楚哪条对应哪台电脑回头排查权限问题会省很多事。3. 核心实践WorkBuddy 驱动知识库自动化3.1 Skill 机制把常用整理流程固化成模板WorkBuddy 最有价值的功能是 Skill简单说就是把一段常用的大 prompt 封装成一条命令下次只要斜杠呼叫就能执行。这比每次打开对话窗口重新输入一大段要求高效太多了。Skill 通常由一个文件夹组成里面有配置文件描述这个技能的名称和触发词以及核心的 prompt 内容。我写的一个笔记整理 Skill 大致长这样name: tidy-note description: 整理指定笔记输出带摘要、标签和关联建议的结构化 Markdown trigger: /tidy prompt: | 你是一名知识管理助手。请阅读目标笔记的内容按以下结构输出整理后的 Markdown # 核心观点 用 200 字以内总结这篇笔记最重要的信息用自然段落描述不要列点。 # 关键细节 列出 3-5 条支撑核心观点的具体内容。 # 标签 提取 3-5 个精准标签要求是知识库中已有的主题词优先。 # 关联建议 根据现有知识库内容推荐 2-3 篇可能与本文相关的笔记并说明关联理由。 注意所有内容必须基于原文禁止补充原文没有的信息。这个 Skill 的关键在最后一句禁止补充原文没有的信息。不加这句AI 很容易脑补出看似合理其实不存在的内容整理出来的笔记反而污染知识库。调用的时候在 WorkBuddy 对话窗口输入 /tidy然后拖入或指定目标笔记文件它就会按模板输出整理结果。模板固定了结构输出内容能直接复制回 Vault 里的对应位置不用二次排版。3.2 批量笔记整理摘要、Tag、双链推荐一条龙环境搭好、Skill 配好之后真正进入日常使用节奏。我每周五下午做一次Inbox 清零流程已经完全固定。先把 00-Inbox 里积攒的零散笔记按主题粗略分成几组每组 5 到 10 篇丢给 WorkBuddy 批量处理。对话指令类似这样按 tidy-note 技能处理以下文件夹中的全部笔记 /00-Inbox/本周收集 输出整理后的 Markdown 内容每篇笔记单独成文写到 /30-Resource/整理产出/它会逐个读取文件按模板输出结构化内容生成的文件直接落在指定目录。一次处理十篇笔记大概几分钟质量整体可用。处理完之后我做的第一件事是抽查随机打开两三篇对照原文看摘要是否准确、标签是否跑偏。AI 的标签提取经常会出现两类问题一是过于宽泛任何内容都打上知识管理二是过于冷门自定义标签太多后续根本无法聚合。我的修正方式是维护一份标签白名单在 prompt 里写明优先使用这些已有标签新标签必须给出理由。关联建议这块是惊喜。AI 扫描全库后经常能发现我完全没想到的联系比如一篇半年前写的关于产品定价的笔记和一篇随手记的锚定效应心理学笔记它建议建立双链。这种跨领域关联靠人脑很难回忆起来但对知识网络的质量提升极大。3.3 文献笔记导入Zotero 到 Obsidian 的 AI 加工文献管理是另一个高频场景。很多人的工作流是用 Zotero 管理论文但 Zotero 的笔记功能太弱看完的文献堆在库里再也不打开等于白看。把文献笔记导入 Obsidian 就能解决这个问题。具体做法是用 Obsidian 的 Zotero Integration 插件。先在 Zotero 里装好 Better BibTeX 插件导出引用数据再在 Obsidian 里安装 Zotero Integration设置好文献库路径。之后选中某篇文献执行导入命令Obsidian 就会自动生成一篇包含标题、作者、年份、摘要、链接等元数据的 Markdown 笔记。但这只是第一步因为导入的笔记本质上是文献元数据没有你的理解和思考。我接下来的固定动作是让 WorkBuddy 基于这篇文献做提炼论文解决了什么问题、方法是什么、结论是什么、我可以在哪个场景用它。给 WorkBuddy 的指令是阅读 /30-Resource/文献笔记/xxxx.md 对应的文献摘要 帮我回答1. 这篇文献的核心贡献是什么 2. 它的研究方法或论证逻辑是怎样的 3. 它对我正在做的个人知识库项目有什么可借鉴的点 输出成结构化的知识卡片。产出就是一篇真正的二手知识笔记而不是简单的书目信息。坚持几个月之后30-Resource 里的文献笔记会成为整个知识库质量最高的部分。3.4 让知识图谱活起来Obsidian 的图谱视图默认只展示手动建立的双链刚起步时图谱稀稀拉拉没什么看头。用 AI 补链之后就完全不一样了。我会定期让 WorkBuddy 做一次全库扫描让它读目录索引和每篇笔记的标题找出语义相关的笔记对输出成一组双链建议。然后我手动在对应笔记里添加这些链接或者直接让 WorkBuddy 修改文件。实测下来一个 500 篇笔记的库一次扫描能生成 100 多条有价值的关联建议图谱从稀的变成密的密度上去了之后信息检索的效率明显提升。配合 Dataview 还能做动态聚合。比如我用这条查询列出资源目录下所有带文献标签的笔记TABLE file.mtime as 修改时间, 作者, 年份 FROM 30-Resource/文献笔记 WHERE contains(tags, 文献) SORT file.mtime DESC这个组合很有意思WorkBuddy 负责在内容层面建立连接Dataview 负责在展示层面动态聚合手动整理和自动整理开始形成闭环。4. 同步方案Gitee 仓库实操全流程4.1 初始化仓库、提交第一版与 .gitignore知识库内容开始累积之后第一件事就是把它变成 Git 仓库。在 Vault 根目录打开终端执行cd /path/to/your-vault git init提交之前先写 .gitignore把不需要纳入版本控制的东西排除掉。我的 .gitignore 内容如下.obsidian/workspace.json .obsidian/cache .trash/ .DS_Store这里解释一下为什么 .obsidian/workspace.json 必须忽略。这个文件记录的是每个设备上 Obsidian 的窗口布局、最近打开文件等界面状态每个设备都不一样纳入 Git 会导致每次同步都出现无意义的冲突。但 .obsidian 目录里的核心配置还是要提交的换个设备能自动恢复插件设置所以只排除 workspace 相关文件。接着添加所有文件并做首次提交git add . git commit -m init: 导入现有知识库 git remote add origin gitgitee.com:你的用户名/my-knowledge-base.git git push -u origin master如果你本地默认分支叫 main把最后一句的 master 改成 main 即可。Gitee 新建仓库时默认分支名可以在设置里指定最好提前统一省得后面来回切换。4.2 定时自动提交Obsidian Git 插件配置手动在终端敲命令太反人类所以 Obsidian 里装好 Git 插件之后自动化就交给它。Obsidian Git 插件的设置项里把自动备份间隔分钟设为 30 或 60插件就会每隔一段时间自动执行 add 和 commit。再把Pull on startup打开每次打开 Obsidian 时自动从远程拉取最新改动。提交信息建议用模板比如automatic backup {{date}}这样查看历史时知道每条记录是自动还是手动提交。这个插件的核心价值是消除推不推的决策成本把同步变成呼吸一样自然的事。我连续用了一年多基本没再手动敲过 Git 命令。需要留意的是自动提交只是本地 commit不会自动 push。插件设置里有Push after commit选项打开它才能让改动真正到 Gitee。这两个选项要同时开否则备份只在本地换个设备根本拉不到。4.3 多端同步与冲突处理多端同步最怕冲突。我的使用场景是公司电脑写工作笔记家用电脑写个人笔记偶尔两边都会改同一个文件。冲突本身不可怕问题在于很多人不知道怎么处理冲突标记。当 Git 检测到同一文件两边都有修改时会把它标记为冲突文件内容里出现这种片段 HEAD 公司电脑上修改的内容 家用电脑上修改的内容 别的地方修改的内容处理方法很简单把两个版本的差异看清楚手动保留需要的内容删掉 、、 这三行标记然后 commit 一次冲突就解决了。Obsidian Git 插件的 Source Control 视图能直接列出冲突文件不用去终端翻。我的实战经验是尽量别让两台机器同时大量编辑同一批文件。知识库的天然工作流是一台电脑是主力另一台只读为主这样冲突概率极低。如果某段时间确实两边都在频繁写就养成动手前先 Pull写完马上 Push的习惯窗口期越小越安全。4.4 附件与大文件策略Gitee 对单文件大小有限制接近 100MB 的文件会直接 push 失败。知识库里最占空间的就是 PDF 文献、高清截图、录音文件这些不适合进 Git。我的策略是文本和图片分开管。文本 Markdown 全部进 Gitee因为这才是知识库的核心资产。大附件放本地或者用单独的网盘目录做备份_Attachments 目录里只放压缩过的小图片。截图工具我统一设置了输出为 JPG 格式画质损失可以接受但单张从 2MB 降到 300KB效果非常明显。如果某类附件实在必须进仓库比如团队共享的资料包可以研究 Git LFS。不过我的建议是能不进就不进知识库应该以文本为主附件是辅助材料让 Git 仓库保持轻量同步速度和稳定性都会好很多。5. 常见问题与排查实录5.1 Obsidian 打不开或界面异常很多人遇到 Obsidian 突然打不开第一反应是重装其实大概率是第三方插件冲突。我遇到过一次装完某个社区插件后启动就闪退处理方式是重启 Obsidian 时按住快捷键进入安全模式默认禁用到一半的插件能正常启动后去第三方插件列表里逐个启用排查最后定位到是那个插件的版本和当前 Obsidian 版本不兼容降级解决。Vault 路径有中文、或放在系统权限受限的目录也可能导致启动异常。Obsidian 安装之后把 Vault 放到 C 盘用户目录或者 D 盘独立文件夹避开 Program Files 这类需要管理员权限的位置。顺手再检查一下杀毒软件有没有拦截 Obsidian 的写入操作这也是一个容易被忽略的原因。5.2 Gitee 推送失败与 SSH 密钥问题push 失败的报错五花八门我把最常见的几条列成速查表报错现象根本原因解决办法Permission denied (publickey)SSH 公钥没配置或配置错误重新生成密钥并添加到 Gitee再用 ssh -T gitgitee.com 验证HTTP Basic: Access deniedHTTPS 方式密码错误或开启了双重验证改用 SSH 方式推送或使用 Gitee 生成的私人令牌作为密码remote: error: File xxx is larger than 100MB单个文件超过限制把该文件移到仓库外用 .gitignore 排除后重新提交failed to push some refs本地落后于远程先 git pull --rebase 拉取合并再重新 pushAuthor identity unknown没配置用户名和邮箱git config --global user.name/user.email最坑的是后两种情况同时出现pull 时冲突push 时又被拒。这时候我建议先 git status 看当前状态把冲突文件手动解决后提交然后再 pull 一次确保同步。心态别急Git 的历史记录都在最坏情况也不过是合并错了再回滚不会真的丢数据。还有个小细节换了电脑之后经常忘了配置 Git 用户名和邮箱push 出来的记录显示成未知作者。尽早把这两条全局配置固定下来别每次在新的环境里重来一遍。5.3 WorkBuddy 输出不准与幻觉控制AI 处理知识库内容最大的坑是幻觉。它会在总结时一本正经地编造原文没有的观点如果不核对直接写回知识库等于把错误信息沉淀成永久资产。我控制幻觉的办法有三个。第一在 prompt 里强制限定来源明确写只允许基于给定文件的内容回答禁止推断和补充。第二要求输出内容包含可追溯的原文片段比如在总结观点时引用原文的一句话作为依据。第三批量处理后必须抽查特别是涉及数据、结论、引用的笔记逐条对照原文。上下文管理也很重要。一次让 WorkBuddy 读太多文件它会抓不住重点输出反而变差。我一般把单次处理控制在 10 篇以内或者让它先在目录索引里筛选再针对筛选结果深入处理。宁可多跑几次也别贪多。最后一条心得调整 prompt 之后先用一篇典型笔记试跑看输出结构是否符合预期再放量处理。直接全库跑万一模板有问题产出的笔记全要返工浪费时间。5.4 同步冲突与数据丢失恢复数据丢失这件事我经历过一次刻骨铭心的教训。有次在家电脑大改了一篇项目笔记忘记 push 就关了机。第二天在公司电脑上继续改同一篇直接覆盖了家电脑的版本等回到家才发现改动丢了。从那以后我养成了一个习惯涉及重要笔记的修改一定在动手前拉动远程最新版本改完立刻 push。Gitee 网页端的仓库文件页可以看到每个文件的历史版本如果本地误删或误改可以直接网页回滚到某个历史提交比命令行恢复直观得多。Git 的 log 命令也能查到完整提交历史git log --oneline --author你的名字我现在的兜底方案是三层Gitee 远程仓库是最新一层git log 历史是第二层每月月底手动把整个 Vault 压缩打包丢一份到本地备份盘。三选二能对上数据基本就丢不了。这套知识库我用了两年多中间经历过误删、误改、硬盘报错一次都没有真正丢过笔记。到最后真正让这套组合跑起来的不是某个技巧而是形成了固定节奏日常记录无脑丢 Inbox周六抽半小时让 WorkBuddy 整理清零Gitee 自动同步兜底。三位一体里 WorkBuddy 负责把记下来变成用得上的结构Obsidian 把结构组织成网络Gitee 让这一切永远不会因为一次意外归零。如果你也想给知识库注入 AI 能力这套组合可以直接照搬起步再用自己的使用习惯慢慢调。