Claude-Mem 是什么:编程 Agent 如何跨会话记忆
Claude-Mem 性能与成本:测量有用记忆
同时记录供应商 Token、检索相关性和持续运维负担
Claude-Mem 性能与成本:测量有用记忆知识学习CN编辑简报更新 2026-10-08
你将学会
- 列出成本来源
- 先量质量再量节省
- 观察队列与存储
开始前需要
- 合成的双会话项目
- 一种受支持宿主
- 明确选择的记忆供应商
用合成的两次会话,再做排除和删除检查
先看结论
- 上游节省数据未经本文验证。
- 相关性比记忆总量更重要。
- 队列与存储增长也会增加成本。
列出成本来源
生成观察记录可能调用配置的模型供应商。本地 worker 保存结构化数据和向量数据;远端或托管路径还可能产生额外服务费用。
README 的节省 Token 和试用描述、生产指南中的历史节省百分比都属于上游说法。我们没有复现,也没有核对当前商业条款。
先量质量再量节省
在小项目中比较关闭和开启记忆的第二会话任务,数清正确取回的事实、错误插入、提示词 Token 和人工修正。
`ContextBuilder.ts` 会按输出预算裁剪选中的观察,统计也以这些记录为准。实际节省多少仍取决于任务、历史和客户端。
观察队列与存储
生产指南建议关注待处理消息、失败工作、活动会话、SQLite WAL 和 Chroma 增长。这些是可用的诊断类别,阈值仍需按自身负载设定。
把冷启动、观察生成、检索时延和存储增速分别记录。本文没有运行吞吐量或费用基准测试。
如何选择
| 比较维度 | 方案 A | 方案 B |
|---|---|---|
| Best when | You need predictable behavior and easy auditing | You need adaptive optimization and have reliable telemetry |
| Main risk | May leave performance on the table | Can become difficult to explain or debug |
实施步骤
- 1
选择可重复的双会话任务。
- 2
记录有用和误导性的记忆。
- 3
同一供应商条件下测量 Token、时延和存储。
可复制示例
csv
task,provider,baseline_tokens,memory_tokens,useful_facts,wrong_facts,review_minutes
trial,,,,,,not-run常见问题
README 的节省比例适用于我吗?
本系列没有数据可支持直接套用,应做相同任务的对照。
保存越多记忆就越好吗?
无关或错误记录可能增加提示词和人工审阅成本。
资料来源
- Claude-Mem / README.md来源核查 2026-10-08
- Claude-Mem / docs/production-guide.md来源核查 2026-10-08
- Claude-Mem / docs/architecture-overview.md来源核查 2026-10-08
- Claude-Mem / docs/api.md来源核查 2026-10-08
- Claude-Mem / src/services/context/ContextBuilder.ts来源核查 2026-10-08