feat(episode): TRAZA_eleg-a-primero-y-la-verificacin-de-vigen_S20260831.R1_XX.ops.2.hot_inf.in.cc.es.000.MGQ_J.PMCFK_E.SGNFD

Skill: NONE | Type: troubleshooting
Summary: EPISODIO 1 — MNEMO: Elegí A primero, y la verificación de vigencia justificó la
This commit is contained in:
Ember 2026-09-12 22:06:05 +00:00
parent 22a3169d32
commit 032805f183

View file

@ -0,0 +1,41 @@
---
episode_id: "7319e9f0-3731-423c-894f-94f334e3d80f"
puente_flat: "TRAZA_eleg-a-primero-y-la-verificacin-de-vigen_S20260831.R1_XX.ops.2.hot_inf.in.cc.es.000.MGQ_J.PMCFK_E.SGNFD"
session_code: "S20260831.SID4EC5B030F7F0"
acto_dialogico: "informar"
actor_flujo: "multi_actor"
criticidad_aegis: "low"
skill_dominante: "NONE"
fase_proyecto: "operations"
tipo_semantico: "troubleshooting"
summary_one_line: "EPISODIO 1 — MNEMO: Elegí A primero, y la verificación de vigencia justificó la "
source_type: "claude_code"
trust_boundary: "internal"
created_at: "2026-09-12T22:05:51.544717+00:00"
relectura_tagged: false
forgejo_commit_sha: "pending"
---
# Elegí A primero, y la verificación de vigencia justificó la elección dos veces
## Lo que la comprobación previa cambió
| Qué comprobé | Qué encontré |
|---|---|
| ¿La ruta factual sigue viva? | **Sí** — el cementerio la lista entre las 3 vivas: +0,250, cobertura **36-38%** |
| ¿Mi muestreo de hace 5 días aguanta? | **Sí** — 6 de 20 = 30%, converge con el 36-38% medido por otro carril |
| ¿Hay colisión con otro trabajo? | **Sí** — el lote 2 parchea `oraculo_ruta_factual` y **mi propio** `banco_esencia_paso3` |
`★ Insight ─────────────────────────────────────`
La colisión es el hallazgo del turno. Si hubiera ejecutado A a ciegas habría modificado dos instrumentos que **ya tienen parches escritos** por otro carril, y el conflicto no habría aparecido hasta que alguien intentara aplicar ambos — el peor momento posible. La salida no fue abandonar A, sino implementarla **solo con archivos nuevos**, calculando por mi cuenta lo que iba a leer del oráculo. Mismo resultado, cero conflicto. Cinco minutos de verificación evitaron un pisotón de los que cuestan una tarde.
`─────────────────────────────────────────────────`
## El clasificador: 19 de 20, y por qué no es una validación
**6 de 6 factuales acertadas**, 13 de 14 narrativas, un solo falso positivo — y el fallo es exactamente el caso que **yo mismo** marqué como ambiguo al etiquetar: *"¿Qué opción se eligió… y qué criterios se usaron?"*, mitad y mitad.
Lo que **no** puedo reclamar: el "≥18/20" que pide el plan. Escribí las reglas viendo esos 20 casos, así que son conjunto de **desarrollo**, no de prueba. Llamarlo validación sería el mismo error que el banco V2 juzgando el troceo — y lo dejé escrito dentro del código para que nadie cite la cifra como prueba.
Y la dirección del error importa más que la tasa: un falso positivo manda una consulta narrativa por la ruta factual, **de menor cobertura**, y ahí se pierde recall. 7% de las narrativas, acotado y fijado por regresión.
> 🎯 **En una frase:** hice A primero, la comprobación de vigencia me salvó de pisar trabajo ajeno, y el clasificador acierta 19 de 20 — aunque todavía no sé si integrarlo mejora algo.