短期摘要层
把历史消息压成可继续使用的 running_summary,控制上下文长度。
context它更像可嵌入的 memory 能力层:短期上下文通过 RunningSummary 压缩,长期记忆通过 MemoryManager / BaseStore 写回,隔离和路由则交给 namespace 与 auth。
这一段只讲模型真正可见的材料,不把所有底层状态都算进 context。
短期摘要、长期记忆检索和命名空间路由是三条同时作用的链。
先看组成块,再看顺序。这里最容易帮助普通读者分清“哪些东西会真的进模型”。
把历史消息压成可继续使用的 running_summary,控制上下文长度。
context从对话中抽取、更新、删除可持久化记忆。
memory先生成 query,再从 memory store 检索相关候选。
retrieval根据 RunnableConfig[configurable] 动态解析 namespace。
routing把 memory 处理延后到后台或远端执行。
execution长期状态落在注入式 BaseStore,并受 auth/namespace 约束。
storage不要把记忆想成一个抽象黑盒。这里直接按时间顺序讲“它什么时候生成、存哪、怎么再回来”。
langmem 的 memory 更像图节点与 store 管理器的协作,而不是一个统一数据库动作。
很多误解都来自把 transcript、summary、文件、数据库和向量库混成一层看。
短期状态、命名空间、隔离和长期存储分别属于不同层,不是同一块数据库。
这部分是防误解,不是额外功能清单。
把 langmem 当成完整 agent runtime,而不是 memory/context 组件。
先理解短期上下文,再看长期 memory,最后看存储与后台执行。
每个结论都要能往下追。这里列的都是站内证据入口,不是营销材料。
如果你想继续看原文、行号和分专题分析,可以直接跳到证据页。
站内会把这个 repo 对应的 docs 文件按行展开,方便核对路径和行号。
你也可以直接从总览、仓库入口页和 5 篇专题页继续追。