这一节先看一个更基础的问题:为什么收藏了那么多资料,真正要用的时候还是想不起来、找不到、用不上。只有理清楚这个问题,我们的胶囊系统才不会变成一个更大号的收藏夹。 大多数人都有这样的经历:看到一篇文章,当时觉得很有用,顺手就点了收藏。过几个月,写东西或者做方案时突然想起曾经收藏的这篇文章有这个观点,但又想不起它在哪个平台、叫什么标题。 于是只能重新翻微信收藏、浏览器书签、截图相册、聊天记录。找了一圈,可能找到了,也可能没有。即使找到了,还要重新读一遍,重新判断它到底有没有用。 这不是个别人的习惯问题,而是现在的信息环境造就了这种现象:我们既不愿意花大力气去整理,但又割舍不掉海量的信息资源。 很多人的信息管理经验,最后可以概括成一句话:收藏了很多,记住的很少,能用上的更少。
1.1 传统知识库解决了什么,又没解决什么
传统知识库首先解决的是保存问题。网页可以保存,文章可以剪藏,PDF 可以归档,图片可以放进相册。这当然有价值。至少资料不再完全散落在平台里,后面还有机会找回来。
但保存下来并不代表就有价值。
一个资料真正有用,至少要经过几层变化。它要能被找到,要能被理解,要能和已有资料产生链接关系,还要能在写作、决策、学习、复盘时被重新调用。如果只是原样保存,那么它和放在平台收藏夹里没有本质区别,只是换了一个地方继续沉睡。
传统知识库常见的问题有几个。
-
入口分散。微信文章、网页链接、截图、PDF、语音笔记、聊天记录,每一种资料都有自己的保存方式。你以为自己在搭知识库,实际上只是在维护多个收藏入口。
-
检索依赖关键词。你必须记得标题里有什么词,或者原文大概怎么说。可人真正回忆一段资料时,往往记住的是意思,不是原词。你记得“之前看过一篇讲 Agent 调用办公工具的文章”,但原文可能写的是“AI 操作企业协同软件”。这会造成检索困难。
-
重复资料会越来越多。今天存一篇飞书 CLI 的介绍,明天又存一篇 Agent 调用飞书的实践。它们不是完全相同的文章,但都在讲同一个主题。如果系统只会把它们一条条保存下来,你得到的不是知识积累,而是重复材料的堆积,这会造成信息冗余。
-
第 4 个问题不是那么容易显现,但又至关重要:资料没有进入自己的知识结构。很多知识管理工具会强调标签、双链、图谱,但这些东西只是形状。图谱画得再漂亮,如果你没有真正比较、复述、改写、输出,这些资料仍然只是外部资料,无法内化成你自己的知识。
所以胶囊系统并不打算做一个普通意义上的知识库。叫知识库,反而把问题说小了。
1.2 我们真正想要的系统
我想做的是一个可以接收、压缩、标记、融合、内化的外部材料的系统。
第一,系统能接收外部材料。链接、图片、文字、PDF、语音,都可以被放进来。 第二,它不是把材料原样堆起来,而是要把它压缩、标记、融合,变成以后可以被重新打开的知识单元。
这个系统至少要能做四件事:
第一,资料写入要方便。 用户不应该为了存一篇文章,还要思考目录、标签、格式。只要看到有用材料,无脑丢给胶囊系统,剩下的事情由系统处理。
第二,资料要好查。 查找不能只靠关键词。你用自然语言描述一个模糊印象,系统也应该能找到相关资料,并且告诉你为什么它相关。
第三,重复资料要能融合去重。 同一主题下的多篇文章不应该只是多几条记录(独立不相干的记录,就意味着有很多冗余的信息),而应该更新同一张主题页。新资料补充了什么、纠正了什么、和旧资料有什么不同,都应该被整理出来。
第四,资料要能推动内化。 这里的内化不是一句口号。它至少意味着,系统能把新资料融合进已有主题,合并重复观点,标出冲突,校正旧判断,让用户每次回到同一条知识线时,看到的都是一篇更完整、更贴近当前理解的知识文章。
当然,实现上述的规划,你可以用任何你喜欢的工具,比如 Obsidian、Notion等。本教材我们选择使用 Hermes+飞书。
飞书拥有知识库、云文档、多维表格、消息、搜索,这些能力都很成熟。而 Hermes 适合做理解、判断、归类、改写、融合和流程串联。
这一章后面要做的,就是把这个系统一点点搭出来。
1.3 ■ 学点英语
| 中文 | English | 音标 | 说明 |
|---|---|---|---|
| 知识焦虑 | Knowledge Anxiety | /ˈnɑːlɪdʒ æŋˈzaɪəti/ | 资料越存越多但无法转化为判断的状态 |
| 知识系统 | Knowledge System | /ˈnɑːlɪdʒ ˈsɪstəm/ | 把资料、主题和复盘组织起来的长期系统 |
| 语义检索 | Semantic Search | /sɪˈmæntɪk sɜːrtʃ/ | 按含义相似度而不是关键词匹配来查找内容 |
| 资料融合 | Content Fusion | /ˈkɑːntent ˈfjuːʒən/ | 把多份相关资料合并成新的结构化内容 |