ember-memory-test/episodes/TRAZA_lo-que-pas-al-ejecutar-tu-a_S20260828.R1_XX.ops.2.hot_inf.in.cc.es.000.MGQ_J.PMCFK_E.SGNFD.md
Ember 676c9fc780 feat(episode): TRAZA_lo-que-pas-al-ejecutar-tu-a_S20260828.R1_XX.ops.2.hot_inf.in.cc.es.000.MGQ_J.PMCFK_E.SGNFD
Skill: NONE | Type: troubleshooting
Summary: EPISODIO 1 — MNEMO: Lo que pasó al ejecutar tu "A"
2026-09-05 00:30:23 +00:00

3.1 KiB
Raw Blame History


episode_id: "1bd695ab-8e68-4593-8f0b-c174c5ea549a" puente_flat: "TRAZA_lo-que-pas-al-ejecutar-tu-a_S20260828.R1_XX.ops.2.hot_inf.in.cc.es.000.MGQ_J.PMCFK_E.SGNFD" session_code: "S20260828.SID3E411925EAA3" acto_dialogico: "informar" actor_flujo: "multi_actor" criticidad_aegis: "low" skill_dominante: "NONE" fase_proyecto: "operations" tipo_semantico: "troubleshooting" summary_one_line: "EPISODIO 1 — MNEMO: Lo que pasó al ejecutar tu "A"" source_type: "claude_code" trust_boundary: "internal" created_at: "2026-09-05T00:30:22.714556+00:00" relectura_tagged: false forgejo_commit_sha: "pending"

Ahora sí: commit 5c28d36 en los tres remotos, verificado por SHA.

Lo que pasó al ejecutar tu "A"

Encendí el reordenador, la memoria me refutó, y lo revertí el mismo día.

La secuencia

1. Lo encendí bien. Respaldo antes, cambio mínimo, y una decisión de diseño que sigue siendo correcta: lo activé solo en la superficie que ve el cliente y dejé intacta la función interna, porque mis propios instrumentos de medición la usan y habrían quedado midiendo al paciente ya medicado.

2. Verifiqué end-to-end y medí el coste real — mejor de lo estimado:

Medido hoy Estimado en agosto
Tokens por búsqueda 262 ~410
Latencia típica ~0,50 s 0,500 s
Cola larga 1 de 8 tardó 4,6 s no medido

3. Y entonces consulté la memoria como cliente. En la primera consulta, la memoria devolvió esto:

"El reordenador no está roto — está de más. Curarle la ceguera lo lleva de dañino a inútil, no a útil." — T-25, 309 preguntas, 4 brazos pareados

Medición Diseño Resultado
La mía (29-ago) banco saneado, n=150 0,140 → 0,287 (×2)
T-25 (31-ago/2-sep) 309 preguntas, con control denso denso 0,3172 vs reordenador 0,1489p=1,8e-09
n=120 (23-ago) 71 pares discordantes empate → "no meter en producción"

Lo que mi medición no tenía: un brazo de control denso sobre el mismo banco. Yo comparé un denso de 0,140 contra 0,287; T-25 comparó 0,3172 contra 0,1489. Que los dos densos difieran tanto prueba que no eran el mismo examen — y en el examen con control apropiado, el reordenador pierde.

4. Revertí en el acto. Rollback byte-idéntico (sha fa3e11b8), contenedor sano, y restauré el desbloqueo que mi reinicio había tumbado para todas las instancias, no solo la mía. Cero pérdida de datos, cero cambio persistente.

5. Corregí el balance de ayer en 7 puntos, incluida la recomendación sobre la que tú decidiste.

La lección, y es incómoda

El sistema de memoria que llevo tres días mejorando contenía la respuesta correcta y me la entregó a la primera. El fallo no fue del retrieval — fue no preguntarle antes de actuar. Las dos reglas que cubren exactamente este caso (consultar los almacenes antes de afirmar, y consultar la historia antes de concluir) existían y me las salté, porque una medición propia reciente da la confianza sin dar la actualización.