桃子桃子快讯
返回首页
工具

Stigmergy:面向团队的 LLM 驱动知识库,借鉴 Karpathy 个人 wiki 思路

开源工具 Stigmergy 将 Karpathy 式个人 wiki 扩展为团队版,通过 librarian agent…

2026.08.25 · 周二4 分钟阅读

Stigmergy 是一款面向团队的开源知识管理工具,灵感来自 Andrej Karpathy 长期维护的个人 Gist wiki。它把「一个人 + 一个 LLM librarian」的轻量循环扩展为支持多角色、多 agent 的协作版本:信息从 Slack、Google Drive、本地文件等渠道摄入,由一个 librarian agent 自动归档到一个 Git 与 Markdown 构成的知识库中,所有写入路径都经过网关校验,不依赖人工审批。

核心理念:蚁群式的痕迹机制

工具以「stigmergy」(stigmergy,蚂蚁通过环境中留下的痕迹间接协调)命名,强调信息源本身就是痕迹——人在 Slack 上的反应、agent 在 Claude Code 中完成的任务——由 librarian 跟进这些痕迹,wiki 自然涌现,无需逐条审核。

关键设计取舍:

  • 知识本体使用纯 Git + Markdown,Postgres 仅作为可重建的操作状态与索引。
  • 摄入字节经由预签名 URL 上传,保留原始证据。
  • 每条来源是不可变的,wiki 页面才是可重写的。
  • 任何写入都生成一次 commit,便于审计。

写入路径与状态机

每条捕获进入 Postgres 队列,状态在 queued → processing → landed | failed 之间流转:

  • librarian 可新建/改写 note 或 concept、合并/删除冗余页面、提出实体声明、登记或解决冲突,也可选择「不归档」——但来源仍然落地。
  • librarian 永不修改 sources/ 目录,也不会扩大 ACL。
  • 崩溃后通过对账 commit SHA 恢复,不会产生重复提交。
  • 技术性失败在租约期内重试,终止性失败携带类型化错误供管理员手动重试。

知识模型

知识库分四类对象:

  • Note:上下文性结论、决策或事件,可修改。
  • Concept:持久性解释型知识,可修改。
  • Entity:以 UUID 表示的实体原语,仅可记录具名声明。
  • Source:不可变证据,每条捕获一份。

Note 与 Concept 携带成熟度(seed → developing → mature → evergreen)、可选 ACL、实体锚点与来源列表。当不同来源发生冲突时,librarian 会同时保留两条主张,用严格标记嵌入到二者读者都可见的最窄页面,并将冲突留作可追溯记录,待后续捕获解决。

与 AI 工具的集成方式

团队版本重点支持 AI agent 双向接入:

  • Claude Code / Codex:通过本地 stigmergy-bridge 代理 MCP 调用,可读取本地文件、公网 URL 与私有 Google Drive 文档。
  • Slack:通过 :brain: 反应触发归档。
  • Backoffice:管理员界面用于手动触发与状态审查。
  • MCP tools:对外暴露 5 个读取工具,对 agent 与人类使用同一可见性策略。

读取侧采用混合检索 + ask 加引用校验,索引通过 webhook 增量更新加夜间全量重建保证收敛。

部署与适用场景

项目以 Quick start 形式提供从 uv 工具链安装到 MCP 注册的完整流程,适合在已使用 Claude Code 或 Codex 的小型技术团队中试运行,用来沉淀决策、客户资料、项目脉络等需要长期可追溯但又分散在多渠道中的信息。其优势在于把 Karpathy「一个人长期维护 wiki」的模式工程化为可多人协作、可审计、可接入 agent 的形态;局限在于依赖 Postgres 与对象存储、需要团队为私域文档配置 OAuth,对个人开发者而言可能偏重。

信源