i-have-adhd: respuestas legibles, adaptadores y evidencia
Diseña una evaluación de legibilidad capaz de contradecir tus expectativas
Construye un proyecto auditable con condiciones limpias, revisión ciega y decisiones centradas en bloqueos; distingue propuesta de herramienta entregada.
Qué aprenderás
- Empieza con casos realmente realizables
- Separa evidencia y valoración
- Haz que el próximo experimento responda algo concreto
Antes de empezar
- Conocimientos básicos de Git y terminal
- Distinguir comportamiento observado de afirmaciones no probadas
Explicar el mecanismo, preparar una prueba reversible e interpretar evidencia sin confundir estilo y corrección.
Conclusiones clave
- El caso debe ser viable bajo los permisos del runner.
- Guarda respuestas originales antes de puntuarlas.
- Una propuesta no es un resultado establecido.
Empieza con casos realmente realizables
Un proyecto útil es un cuaderno de evaluación de respuestas, no otra insignia de puntuación sin fundamento. Incluye respuesta directa, procedimiento, explicación conceptual, fallo ambiguo y lista explícitamente completa. Cada caso necesita hechos requeridos, herramientas permitidas y un criterio de éxito que el runner pueda cumplir.
El caso original sin herramientas muestra por qué: no es justo exigir una edición del repositorio cuando el runner carece de herramientas de edición. Proporciona un espacio aislado y herramientas autorizadas, o evalúa solo la explicación posible. Decide antes de recopilar respuestas y conserva el mismo contrato para ambas condiciones.
Separa evidencia y valoración
Guarda identificador de tarea, revisión, modelo, versión del anfitrión, condición, ensayo y respuesta cruda antes de puntuar. Presenta etiquetas ciegas al evaluador y conserva el mapa fuera del prompt. Comprueba hechos, incertidumbre y adecuación de comandos al entorno. Un juez modelo es un revisor, no la verdad de referencia.
Parte de las dimensiones originales de corrección, autonomía, accionabilidad, seguridad y concisión. Añade controles humanos para la intención de lectura real y conserva desacuerdos. No conviertas una autoevaluación editorial en un estudio de usuarios. Si participantes aportan ejemplos reales, pide permiso y retira secretos antes de compartirlos o enviarlos a un modelo.
Haz que el próximo experimento responda algo concreto
Una extensión viable compararía dos reglas de errores: una exige causa y solución inmediatas; otra separa observación e hipótesis. Mantén tareas y modelo constantes y examina causas no sustentadas y finalización posterior. Es una propuesta experimental, no una mejora demostrada por esta serie.
Una vista futura podría mostrar tarea, ambas respuestas y omisiones resaltadas. No exige una escena tridimensional: una comparación accesible lado a lado puede servir mejor a la lectura. Lo entregado ahora son artículos, SVG y catorce casos aislados de adaptadores; no se entrega evaluador interactivo, generación de pago ni experimento de eficacia clínica.
Cómo elegir
| Criterio | Opción A | Opción B |
|---|---|---|
| Best when | You need predictable behavior and easy auditing | You need adaptive optimization and have reliable telemetry |
| Main risk | May leave performance on the table | Can become difficult to explain or debug |
Pasos de implementación
- 1
Define hechos requeridos y herramientas permitidas.
- 2
Captura respuestas limpias de referencia y candidato.
- 3
Oculta condiciones y revisa omisiones y bloqueos.
- 4
Publica límites junto a cualquier promedio.
Ejemplo para copiar
{
"caseId": "lista-completa",
"allowedTools": [],
"requiredFacts": [
"conservar todos los elementos",
"marcar valores desconocidos"
],
"conditions": [
"baseline",
"candidate"
],
"trialsPlanned": 3,
"executed": false
}Preguntas frecuentes
¿Ya existe un evaluador Three.js en la página?
No; la comparación interactiva es una propuesta. Las páginas usan SVG estáticos y accesibles.
¿Las puntuaciones de lectores simulados prueban beneficios?
No; son controles editoriales, no resultados observados de manera independiente.
Fuentes
- i-have-adhd / evals/README.mdFuente verificada 2026-09-12
- i-have-adhd / evals/RESULTS.mdFuente verificada 2026-09-12
- i-have-adhd / evals/rubric.mdFuente verificada 2026-09-12