公开分享稿 · 26 页 · 版本 2026-09-03
长期记忆不是向量库
一套从来源、时间与冲突出发,闭合到行动、验证与行为改变的多 Agent 连续性设计
Starshard Research Notes
一句话
长期记忆是一条运行合同:带来源、有效期和冲突状态的主张进入规则与权限,再通过行动、回执、目标侧验证、修复与行为改变闭环。
怎么读(10 分钟)
- 先读 p2 阅读合同(证据边界)
- 再读 p24 还没闭合的部分
- 最后做 p25 三问自测
想细读,再从 p3 系统图开始。
目录
ARC A · 01–03 · 从检索转向控制
- 01一个 Agent 忘了,是聊天问题;多个 Agent 一起忘,是控制问题
- 02关键规则不能等 Agent 想起来再搜
- 03摘要可以重写,原始经历不能被摘要取代
ARC B · 04–07 · 事实 · 时间 · 负知识
- 04Hot/cold 的分界,不是"重要"和"不重要"
- 05不知道,不等于反对;空白,不等于冲突
- 06别删除失败:系统会把它重新发明一遍
- 07来源、置信度与权限必须拆开
ARC C · 08–11 · 并发 · 权力 · 完成语义
- 08done 不是 verified
- 09Liveness、authority、effect admission 是三条轴
- 10Lease 解决认领,fence 才处理迟到写
- 11发出去,不等于闭环
ARC D · 12–14 · 从经历到行为改变
- 12Consolidation 不是摘要
- 13记忆只有改变下一次行为,才完成代谢
- 14最重要的能力,是诚实标出还没闭合的器官
此外
- p19四个可重放工件,各自只证明一个边界
- p20一条 claim 应该怎样被降级
- p21不是谁赢,而是哪一段链已经被谁做好
- p22生命体隐喻,只是工程映射
- p23如果从零开始,先实现这十一个接口
它没有解决什么
四个 fixture 的通过,只证明预先编码的合成不变量与预期输出一致;不证明生产有效性、模型服从、隐私安全、独立验证、分布式耐久性或 exactly-once。
- 跨所有真实下游资源的 resource-side fencing;没有 fence 时,停止后的因果触达仍可能未知。
- exactly-once 外部副作用;幂等键、lease 与重试都只能降低风险,不能魔法般提供保证。
- 跨模型、跨媒介统一的 provenance / confidence 标尺,以及来源相关性的建模。
- 自动 consolidation 的长期功效与副作用:规则膨胀、错误固化、过度抽象和身份影响。
- 独立失败域上的验证:换一个 Agent 但复用同一日志,不足以称 independent verification。
- 隐私、保留期、受控删除与公开导出的系统性评估。
- 外部复现与真实受众冷读;目前只有内部公共候选的确定性工件。
配套短文
这份读本的 14 条会以中文短文逐条展开,陆续发布;每条都带一个可复现的合成 fixture、一张「它没解决什么」和一个可推翻它的条件。
反馈
欢迎冷读反馈——读不懂的段落、觉得过度声明的句子、你自己的失败 fixture。
https://github.com/MachengShen/MachengShen.github.io/issues