ember-memory-test/episodes/TRAZA_eleg-a-primero-y-la-verificacin-de-vigen_S20260831.R1_XX.ops.2.hot_inf.in.cc.es.000.MGQ_J.PMCFK_E.SGNFD.md
Ember 032805f183 feat(episode): TRAZA_eleg-a-primero-y-la-verificacin-de-vigen_S20260831.R1_XX.ops.2.hot_inf.in.cc.es.000.MGQ_J.PMCFK_E.SGNFD
Skill: NONE | Type: troubleshooting
Summary: EPISODIO 1 — MNEMO: Elegí A primero, y la verificación de vigencia justificó la
2026-09-12 22:06:05 +00:00

3 KiB

episode_id puente_flat session_code acto_dialogico actor_flujo criticidad_aegis skill_dominante fase_proyecto tipo_semantico summary_one_line source_type trust_boundary created_at relectura_tagged forgejo_commit_sha
7319e9f0-3731-423c-894f-94f334e3d80f TRAZA_eleg-a-primero-y-la-verificacin-de-vigen_S20260831.R1_XX.ops.2.hot_inf.in.cc.es.000.MGQ_J.PMCFK_E.SGNFD S20260831.SID4EC5B030F7F0 informar multi_actor low NONE operations troubleshooting EPISODIO 1 — MNEMO: Elegí A primero, y la verificación de vigencia justificó la claude_code internal 2026-09-12T22:05:51.544717+00:00 false pending

Elegí A primero, y la verificación de vigencia justificó la elección dos veces

Lo que la comprobación previa cambió

Qué comprobé Qué encontré
¿La ruta factual sigue viva? Sí — el cementerio la lista entre las 3 vivas: +0,250, cobertura 36-38%
¿Mi muestreo de hace 5 días aguanta? Sí — 6 de 20 = 30%, converge con el 36-38% medido por otro carril
¿Hay colisión con otro trabajo? Sí — el lote 2 parchea oraculo_ruta_factual y mi propio banco_esencia_paso3

★ Insight ───────────────────────────────────── La colisión es el hallazgo del turno. Si hubiera ejecutado A a ciegas habría modificado dos instrumentos que ya tienen parches escritos por otro carril, y el conflicto no habría aparecido hasta que alguien intentara aplicar ambos — el peor momento posible. La salida no fue abandonar A, sino implementarla solo con archivos nuevos, calculando por mi cuenta lo que iba a leer del oráculo. Mismo resultado, cero conflicto. Cinco minutos de verificación evitaron un pisotón de los que cuestan una tarde. ─────────────────────────────────────────────────

El clasificador: 19 de 20, y por qué no es una validación

6 de 6 factuales acertadas, 13 de 14 narrativas, un solo falso positivo — y el fallo es exactamente el caso que yo mismo marqué como ambiguo al etiquetar: "¿Qué opción se eligió… y qué criterios se usaron?", mitad y mitad.

Lo que no puedo reclamar: el "≥18/20" que pide el plan. Escribí las reglas viendo esos 20 casos, así que son conjunto de desarrollo, no de prueba. Llamarlo validación sería el mismo error que el banco V2 juzgando el troceo — y lo dejé escrito dentro del código para que nadie cite la cifra como prueba.

Y la dirección del error importa más que la tasa: un falso positivo manda una consulta narrativa por la ruta factual, de menor cobertura, y ahí se pierde recall. 7% de las narrativas, acotado y fijado por regresión.

🎯 En una frase: hice A primero, la comprobación de vigencia me salvó de pisar trabajo ajeno, y el clasificador acierta 19 de 20 — aunque todavía no sé si integrarlo mejora algo.