两年前我写第一个 Agent 时,最头疼的问题不是模型不够聪明——而是它每开一个新会话就失忆。后来有了 RAG,有了向量数据库,但新的问题来了:笔记散落在本地,论文在 PDF 里,收藏的网页在书签里,知识图谱自己又建一套。三个库互不打通,召回时各查各的,结果就是 Agent 的「记忆」有缝——同一个话题,FTS5 命中一条,语义检索命中另一条,知识图谱再冒出第三条,没人帮你合并。
Knowledge-and-Memory-Management v0.0.2 的核心理念就一句话:知识的价值不在于存了多少,而在于调用时能一次性拿出全部相关材料。
三层不是三层独立,是一条链
项目实现了 FTS5(SQLite 全文搜索)→ Hindsight(PG16 语义向量)→ gbrain(知识图谱关键词)的链式召回。不是三个接口让 Agent 自己选,是 lightweight_recall.py 一个入口自动走完三级:
用户查询
→ L1: FTS5 全文搜索 (state.db,0.1s)
→ 命中 score ≥ 0.6 直接返回(90% 场景)
→ L2: Hindsight 语义向量 (PG16,<15s)
→ L3: gbrain 关键词搜索 (8787端口,<1s)
→ 三级合并 → RECALL_CONTEXT.md
代码极简:
from knowledge_management.lightweight_recall import recall
result = recall("Agent 记忆系统设计", top_k=10)
print(f"FTS5: {result.fts5_count}, Hindsight: {result.hindsight_count}, gbrain: {result.gbrain_count}")
print(f"最终返回 {len(result.merged)} 条,已去重排序")
比召回更重要的:采集闭环
单纯架个 RAG 谁都会,真正拉开差距的是知识怎么进来的。项目围绕这一点设计了完整的采集管线——网页 9 种引擎(含 Scrapling 反爬)、视频 12 种工具(含抖音批量 ASR)、文档 SenseNova 三件套(PDF/PPT/Word 全量提取)、710+ 本书籍自动精炼管线。采集完,笔记落盘、知识图谱录入、云盘同步一条龙自动跑完,不需要手动搬运。
v0.0.2 还加了知识发现模块——每周日自动扫描 OneDrive 中新笔记、录入 gbrain、修复孤页。你甚至不用主动「保存」,Agent 会自己发现。
开发者视角
这套系统 GitHub 开源(mage0535/Knowledge-and-Memory-Management),基于 hermes-memory-installer 底座,依赖 gbrain + Hindsight。安装就是 bash install.sh 一件事。如果你已经在跑 Hermes Agent,加这个等于给你的 Agent 装上「长期职业记忆」——不是记住聊天历史,是真的能用知识工作。
你甚至可以把它当个人知识库用:采集网页→自动生成笔记→同步到 OneDrive,纯命令行操作,比 Notion 快多了。
Top comments (0)