Blueprint

从 0 到 1 搭一个清楚的 context / memory 管理框架

这里把“用户来消息”到“组装 context”到“写入 memory”到“召回与压缩”的完整链路拆出来,并给三档落地版本。

搭建建议基于 6 个项目归纳
最小原则
  • 先做清楚的边界,再做更多记忆功能。
  • 先区分模型看见什么,再谈存储后端。
  • 多 agent 不是复制一套 memory,而是先想共享范围和回写策略。
01

实现蓝图总图

先把主链画清楚:输入、裁剪、检索、注入、写回、压缩、下轮再用。

实现蓝图总图

先把输入、上下文拼装、记忆读写和压缩这几步拆清楚,再决定后端。

接收输入
先拿到用户消息、工具结果和当前状态。
整理短期上下文
最近消息、当前任务状态、必要系统规则。
召回长期记忆
按 query、规则或实体找回相关记忆。
组装最终 context
把固定说明、当前输入、短期摘要、召回结果拼起来。
模型执行
得到回答、工具调用或结构化输出。
写回与压缩
决定要不要更新长期记忆、要不要压缩历史。
02

三档落地版本

从最小可用版,到可扩展版,再到多 agent 版,层层加复杂度。

最小可用版

只有短期 history + 简单 summary + 文件型长期记忆,优先把边界做清楚。

  • 适合先验证体验
  • 没有复杂检索
  • 人工可检查

可扩展版

在最小版上增加 SQLite state、记忆更新流水线和检索接口。

  • 适合工具型生产系统
  • 压缩、审计和长记忆开始分层
  • 后续可再接向量库

多 agent 版

把共享记忆、私有记忆、线程状态和回写权限拆开设计,再做协调。

  • 优先做共享范围定义
  • 要处理冲突与去重
  • 适合工作流或平台型场景