Claude-Mem: cómo conserva contexto un agente de programación
Coste y rendimiento de Claude-Mem: medir recuerdos útiles
Observar tokens del proveedor, pertinencia y trabajo de mantenimiento
Qué aprenderás
- Identificar gastos
- Medir calidad primero
- Vigilar cola y datos
Antes de empezar
- Un proyecto ficticio de dos sesiones
- Un cliente compatible
- Un proveedor de memoria elegido
Usar dos sesiones ficticias y verificar exclusión, borrado y retirada
Conclusiones clave
- El ahorro anunciado no se verificó aquí.
- Pertinencia importa más que volumen de recuerdos.
- Cola y almacenamiento también cuestan.
Identificar gastos
Generar observaciones puede utilizar un modelo configurado. El worker local guarda registros y vectores; modalidades remotas o alojadas pueden tener cargos adicionales.
Cifras de ahorro y prueba del README y el porcentaje histórico de la guía son afirmaciones del proyecto. No los reprodujimos ni verificamos términos comerciales actuales.
Medir calidad primero
Compare una tarea de segunda sesión con memoria activada y desactivada. Cuente hechos útiles, inserciones erróneas, tokens de prompt y correcciones humanas.
`ContextBuilder.ts` recorta observaciones al presupuesto de salida y calcula estadísticas sobre la selección. El ahorro real depende de tarea, historial y cliente.
Vigilar cola y datos
La guía propone seguir mensajes pendientes, fallos, sesiones activas, WAL de SQLite y crecimiento de Chroma. Sus categorías son útiles aunque los umbrales deban adaptarse.
Registre inicio en frío, demora del observador, latencia de búsqueda y crecimiento de datos por separado. No ejecutamos benchmark de coste ni de throughput.
Cómo elegir
| Criterio | Opción A | Opción B |
|---|---|---|
| Best when | You need predictable behavior and easy auditing | You need adaptive optimization and have reliable telemetry |
| Main risk | May leave performance on the table | Can become difficult to explain or debug |
Pasos de implementación
- 1
Elegir una tarea repetible de dos sesiones.
- 2
Registrar recuerdos útiles y engañosos.
- 3
Medir tokens, tiempo y datos con el mismo proveedor.
Ejemplo para copiar
task,provider,baseline_tokens,memory_tokens,useful_facts,wrong_facts,review_minutes
trial,,,,,,not-runPreguntas frecuentes
¿Puedo aplicar la cifra de ahorro del README?
Esta serie no ofrece mediciones para trasladarla; haga una comparación equivalente.
¿Guardar más siempre ayuda?
Registros irrelevantes pueden aumentar tokens y revisión manual.
Fuentes
- Claude-Mem / README.mdFuente verificada 2026-10-08
- Claude-Mem / docs/production-guide.mdFuente verificada 2026-10-08
- Claude-Mem / docs/architecture-overview.mdFuente verificada 2026-10-08
- Claude-Mem / docs/api.mdFuente verificada 2026-10-08
- Claude-Mem / src/services/context/ContextBuilder.tsFuente verificada 2026-10-08