本地知识库怎么选?Obsidian 之外的 8 种方案
你可能也遇到过这样的情况。
一份方案保存在 AI 对话里,一篇技术文章躺在浏览器收藏夹,一份 PDF 留在下载目录。等到真正需要时,记得自己看过,却想不起它在哪个应用里。
于是,一个很自然的想法出现了:能不能把这些资料放进同一个地方,自己随时查,Codex 和其他 AI 助手也能查?
Obsidian 经常出现在这个问题的答案里。它使用普通 Markdown 文件,适合长期保存,也方便代码工具直接读写。但资料一旦包含大量网页、扫描件、Word 和 PDF,选型就需要多看几步。
除了 Obsidian,还有哪些软件值得考虑?这篇文章围绕 Windows 本地使用,比较 8 个方向不同的选择。
本文根据截至 2026 年 9 月 26 日查阅的官方文档、项目说明及部分发布信息整理,属于选型分析,未对全部产品进行安装实测。版本变化较快的功能,会单独说明适用条件。
先想清楚:你要管理的是文件,还是软件里的知识?
本地知识库大致有两种底座。
一种直接管理文件。正文就是磁盘上的 Markdown,软件负责展示、搜索和关联。Obsidian、QOwnNotes,以及以浏览器为入口的 SilverBullet,都属于值得从这个角度考察的工具。即使换掉软件,文本仍能用其他编辑器打开。
另一种由应用管理数据。它可能使用数据库,也可能使用自己的文档格式。Joplin、思源、TriliumNext、Anytype 和 AFFiNE 采用的具体技术不同,但都不能简单当作普通 Markdown 文件夹操作。
后者往往更方便提供块引用、对象关系、丰富视图和应用内检索;外部工具要读写时,通常应使用 API、MCP 或导入导出功能。
MCP 可以理解为 AI 应用连接资料和工具的一套接口。软件提供 MCP 服务后,支持该协议的 AI 客户端就有机会搜索和读取其中的内容,具体还取决于工具范围、权限与客户端兼容性。
因此,选型可以先问自己:
我更希望资料随时能被普通文件工具使用,还是愿意通过应用接口,换取更丰富的组织能力?

图:两种常见接入路径,并非互斥;普通文件库也可以通过 MCP 提供检索。
8 种工具,各有适合的资料
Joplin:希望收集和检索尽量在一个软件里完成
Joplin 接近传统笔记软件的使用习惯:笔记本、标签、笔记列表和正文编辑器。它支持 Markdown,也提供富文本编辑方式,以离线使用为基础。
它对混合资料比较有吸引力。网页可以通过 Web Clipper 收集,PDF 和图片可以作为附件保存,自己的方案与对话摘录则整理成笔记。官方文档还提供本地 OCR 功能说明:桌面端能够处理 PDF、PNG、JPEG,识别结果可用于搜索。
例如,你收进一篇网页、一份扫描版说明书和一张会议截图,至少不必先把它们全部手工改写成 Markdown,才能开始建立资料库。
它的 Agent 接入也值得关注。当前官方文档列出了 MCP 服务,可按工具开启关键词搜索、语义搜索、读取笔记、创建和更新笔记等能力。
官方语义搜索文档要求 Joplin 3.7 及以上,并列出 Windows 桌面端支持。本次查阅到的最新稳定发布为 3.7.21。语义索引在设备本地建立,适合用自然语言寻找意思相关的笔记;错误码、文件名等精确内容仍适合关键词查询。
需要注意,它内部管理的是数据库和附件,不是一个可直接交给 Codex 修改的 Markdown 目录。外部写入宜通过接口完成。
另外,PDF 的 OCR 能被搜索,不代表识别出的所有内容都一定进入语义索引;Word 能作为附件保存,也不代表正文已经完整解析。两者都需要单独测试。
**适合谁:**网页、PDF、图片和笔记混在一起,希望先用一个软件完成多数收集与查询工作的人。应用可免费使用,官方云同步等服务另有收费。
思源笔记:把长文档整理成可以精确引用的知识
思源的核心是“块”。段落、代码块、列表等内容可以独立引用,不必每次都复制整篇文档。
这个能力很适合处理 AI 生成的长回答。一次讨论可能同时包含背景、几个备选方案、最终决策和待办事项。将它们整理成不同的块后,可以分别引用到设计文档、任务说明和阶段总结里。
思源还提供文档树、双向链接、数据库、网页剪藏,以及 PDF 批注链接。对于希望在中文环境中持续整理项目知识的人,这些能力可以减少“保存之后再也不看”的情况。
在自动化方面,官方 API 支持用 Markdown 创建文档、读写块、上传附件和导出内容。Agent 可以通过接口参与整理,也可以利用块标识定位到具体段落。
代价是存储格式。思源正文使用 .sy JSON 文件,并非普通 Markdown。虽然可以导出 Markdown,但块关系、数据库结构和复杂排版不能据此认定能够无损迁移。
同步方式也有明确边界:官方不支持用普通第三方同步盘直接同步活动工作空间,应使用其支持的同步机制。
**适合谁:**重视中文编辑体验、项目档案、段落引用和知识整理的人。本地核心使用与会员、同步等增值服务需要分别看待。
QOwnNotes:让 Codex 和笔记软件使用同一批文件
QOwnNotes 是一款偏传统桌面风格的 Markdown 笔记工具。它直接使用普通文本文件,支持搜索、标签、预览和脚本扩展,也能检测外部文件修改。
它的价值可以用一个很具体的场景说明:你让 Codex 把方案写进项目目录,QOwnNotes 打开同一个目录供你阅读和整理。修改后的正文仍在那里,不需要再导入一份副本。
已有大量技术笔记、README 和阶段记录的人,可以因此减少重复维护。文本还可以继续使用 Git 或普通文件备份工具管理。
当前官方项目说明已列出内置 MCP,供外部 AI Agent 搜索和读取笔记,也提供浏览器 Web Companion 扩展,可从选中文本创建笔记。
这里要把能力边界说清楚:官方说明中的 MCP 搜索和读取,不等于已经具备所有写入操作或语义检索能力。PDF、Word 正文提取和 OCR 也不应默认包含在文件管理能力里。
**适合谁:**资料以 Markdown、技术文档和 Codex 产物为主,重视文件可迁移性的人。软件免费开源;如果外来办公文档占多数,通常还要补充解析工具。
TriliumNext:同一份知识,可以从多个项目找到
TriliumNext 延续了 Trilium Notes,强调树状结构、属性、关系和自动化。
它有一个值得关注的组织方式:同一篇笔记可以通过克隆出现在多个位置,内容仍是同一份。例如,一份“备份规范”可以同时放在基础设施、项目手册和运维资料的入口下。
当资料量逐渐增加,这种方式能减少重复复制。再结合全文搜索、标签、属性、网页剪藏和笔记间关系,可以形成结构比较细的长期知识库。
官方提供 REST API 和脚本扩展能力,适合通过自动化程序写入资料、维护索引,或者在此基础上接入 Agent。
它的主要成本是学习和维护。正文与结构由应用数据库管理,导出 Markdown 不等于完整带走属性、关系和脚本。多设备使用还需要考虑同步服务器及客户端兼容性。
**适合谁:**愿意规划知识结构,并希望长期积累成体系资料的人。单机桌面使用可以先不部署服务器;软件免费开源。
Anytype:用对象和属性组织资料
Anytype 将项目、文档、人物、任务等看作不同类型的对象,再通过属性和关系连接起来。
一份技术资料可以拥有“所属项目、来源、阅读状态、相关主题”等字段。这样,资料不必只住在一个文件夹里,还可以根据需要出现在不同集合和视图中。
如果你经常想查“某项目里还没整理的网页资料”,这类结构化组织方式会比较直观。
Anytype 强调本地优先和加密存储,也提供官方 API。当前开发者文档列出了文件操作、Markdown 正文修改和属性过滤等能力,具备自动化接入路径。
不过,建立对象类型和属性体系需要投入时间。底层数据不是普通 Markdown,复杂关系导出后也可能难以保留。能够存放 PDF、Word,仍然不能替代对全文提取和 OCR 的验证。
它采用源码可见许可证,不能直接等同于 MIT、AGPL 等开源许可证;如果考虑二次开发,需要看具体许可条款。
**适合谁:**希望把个人资料整理成对象数据库,愿意维护属性和关系的人。如果主要需求是快速投递文件、直接搜正文,未必需要一开始就引入这套结构。
AFFiNE:适合把文档和白板放在一起思考
AFFiNE 将文档、数据库和无限画布结合起来。文字、图片、便签、图形和关联页面可以放进同一工作空间。
研究一个产品时,你可以把网页摘录、截图、不同方案和自己的结论摆在画布上,再整理成正式文档。对于架构讨论、交互设计和项目规划,这种工作方式很有吸引力。
它强调本地优先,也提供协作与自托管方向。但选型时需要把桌面使用、云服务、自托管和 AI 功能分开看,不能认为选择其中一种部署方式就自动获得所有能力。
同样,软件内部有 AI 功能,不等于外部 Codex 已经能访问整个工作空间。外部 API、MCP、权限和导出范围,应以所选版本的实际支持为准。
画布内容很难完整转换为 Markdown,PDF、Word 的全文检索也需要实测。
**适合谁:**经常做图文混合研究、设计和规划的人。它可以是很好的工作台,但是否能成为唯一的文档仓库,要看附件检索和导出结果。
Logseq:适合从每天的记录中逐渐长出知识
Logseq 以大纲和日志为中心。你可以先记录当天的工作、问题、阅读摘录和待办,再用链接与标签建立联系,不必每次都先规划一篇完整文章。
它适合保存 Agent 回答中的片段、追踪某个问题的讨论过程,也支持 PDF 批注等阅读工作流。
但今天介绍 Logseq,必须区分文件图谱和数据库图谱。文件型工作流与 Markdown、Org-mode 有直接关系,数据库版则不能继续按普通文本目录处理。
截至本文查阅时,官方 README 将数据库版标为 beta,新的移动应用与实时协作功能标为 alpha,并建议使用非关键项目测试。这个阶段的选择会影响插件、同步、备份和 Agent 接入方式。
**适合谁:**喜欢大纲、每日记录和持续思考的人。大量外来 Word、PDF 的统一收件与检索,并不是仅靠日志工作流就能解决的问题。
SilverBullet:把 Markdown 知识库放进浏览器,并允许自己编程
SilverBullet 是可自托管、通过浏览器使用的知识库。正文以 Markdown 页面保存,同时提供 Wiki 链接、查询和脚本能力。
它很适合做一些小型自动化:自动列出某项目的文档、生成待整理清单、按属性汇总资料,或让 Codex 生成内容后由浏览器界面展示。
文件仍是容易迁移的文本,系统又留有扩展空间。这对希望逐步搭建个人工具的人有吸引力。
相应地,它需要运行和维护服务,Windows 环境下应先验证合适的安装方式。Word 解析、PDF OCR 和多渠道收集,通常也需要额外组件。
**适合谁:**愿意维护一些配置和脚本,希望拥有可编程知识库的人。软件免费开源,但维护时间也是成本。
真正决定体验的,是几件容易被忽略的小事

图:文本解析、扫描件 OCR、关键词与语义检索需分别验证,保存附件并不代表这些能力全部具备。
第一,附件能放进去,不等于里面的文字能查出来。
把一份 Word 拖进笔记,只能证明它被保存了。要确认内容可用,需要搜索正文中独有的一句话,再检查结果是否能定位回原文件。扫描 PDF 还涉及 OCR,复杂表格则涉及提取顺序和结构。
第二,本地保存,不等于 AI 使用时资料不离开本机。
本地 OCR、本地向量索引和云端问答是不同环节。外部 Agent 通过 MCP 读到资料后,如果使用云端模型,相关内容可能随请求发送给模型服务。应按资料性质选择模型和可访问范围。
第三,可以导出,不等于可以原样迁走。
正文、图片、附件、标签、块引用、数据库关系和画布,可能有不同的导出结果。迁移前最好导出一小部分,在另一个工具里真正打开一次。
第四,接入 Agent,不等于任意应用都能直接访问。
支持 MCP 的客户端还需要配置;只提供 API 的软件可能需要适配;普通桌面应用往往仍依赖剪贴板、快捷键和拖放。对办公文档或档案库,还可以补充专门的全文检索工具,不必强行把所有原件都改造成笔记。
怎样选,才能少走一些迁移的弯路?
可以先按资料主体缩小范围:
- 网页、扫描 PDF、图片与笔记混合,优先试 Joplin。
- 中文项目文档、段落引用和长期整理,优先试思源。
- Markdown、代码项目与 Agent 产物占多数,比较 QOwnNotes 和 Obsidian。
- 复杂树状知识与自动化,考虑 TriliumNext。
- 想用对象、属性和集合组织资料,考虑 Anytype。
- 经常进行图文设计与白板讨论,考虑 AFFiNE。
- 日志、摘录和碎片思考占多数,考虑 Logseq。
- 愿意维护服务和脚本,考虑 SilverBullet。
不必一次安装全部软件。挑两款,用同一批资料完成一轮测试:一篇网页、一份扫描 PDF、一份带表格的 Word、几篇已有 Markdown,以及一段较长的 AI 对话。
然后检查五件事:收进来要几步;中文正文能否查到;搜索结果能否回到出处;修改后内容何时更新;导出后能否继续使用。若需要 Agent,再补一次真实的搜索、读取和写入验证。
一个有用的文档系统,应该让某次保存产生长期价值:几个月后,你能找到它,知道它从哪里来,也能让合适的工具继续使用它。
选择软件时,可以先从一次完整的“收集—检索—引用—导出”开始。
资料来源
- Joplin:MCP、语义搜索、OCR、3.7.21 发布信息。
- 思源:官方项目说明、API 文档。
- QOwnNotes:官方项目说明。
- TriliumNext:官方项目说明。
- Anytype:官方项目说明、API 文档。
- AFFiNE:官方项目说明。
- Logseq:官方项目说明及版本状态。
- SilverBullet:官方项目说明。
本文由 AI 辅助整理,依据公开资料撰写,未以亲身体验或全面实测作为推荐依据。
微信公众号
欢迎关注「字与码」
如果这篇文章对你有用,也欢迎在微信里继续关注后续更新。
X / Twitter
关注 @ax2_zicode
更即时的技术观察、新文章提醒和一些短想法会发在 X 上。