Skill: NONE | Type: troubleshooting Summary: EPISODIO 1 — MNEMO: Arreglado, verificado y con la premisa corregida
2.8 KiB
| episode_id | puente_flat | session_code | acto_dialogico | actor_flujo | criticidad_aegis | skill_dominante | fase_proyecto | tipo_semantico | summary_one_line | source_type | trust_boundary | created_at | relectura_tagged | forgejo_commit_sha |
|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|
| d4863f38-a099-4847-926d-ecbd6d30d149 | TRAZA_arreglado-verificado-y-con-la-premisa-co_S20260828.R1_XX.ops.2.hot_inf.in.cc.es.000.MGQ_J.PMCFK_E.SGNFD | S20260828.SIDE4083C25D9B0 | informar | multi_actor | low | NONE | operations | troubleshooting | EPISODIO 1 — MNEMO: Arreglado, verificado y con la premisa corregida | claude_code | internal | 2026-08-29T15:56:50.466186+00:00 | false | pending |
Arreglado, verificado y con la premisa corregida
El clasificador ya no puntúa el texto que le pegas para que lo lea. Pero lo importante no es el arreglo: es lo que apareció al reproducir el fallo antes de tocarlo.
El mecanismo no era el que decía el encargo. No es "vocabulario ajeno" en general: son dos patrones bilingües accidentales. El patrón \b(adopt|adopta|adoptar)\b incluye la forma inglesa, y el video decía "deciding whether to adopt a new framework" — 3.0 puntos. Sumado a framework (2.0) da exactamente 5.00, el mismo conf=5.00 que el hook reportó aquel día. Reproducción, no conjetura.
Y corregí la premisa: de los tres falsos positivos denunciados, solo uno era de este clasificador. R2 y R3 dan score 0.00 — sus avisos venían del verificador de routing, que es otro hook. Si hubiera aceptado la premisa sin medir, habría "arreglado" dos casos que este componente nunca causó, y el verificador de routing habría seguido igual. Lo dejé explícitamente fuera de alcance: tocarlo sin su propia reproducción sería repetir el error que este trabajo corrige.
El arreglo no inventa nada. Consultando el grafo antes de tocar (AR-AP7) encontré que este archivo ya tiene dos mecanismos de la misma familia: un guard que descarta prompts que empiezan con marcadores de máquina —extendido tres veces por este mismo bug— y un amortiguador para cuando "arquitectura" aparece como dato a graficar. El mío es el cuarto capítulo: la diferencia es que aquí la cita va embebida, no al inicio, y por eso los anteriores no la alcanzaban.
Sobre abrir un falso negativo, que era tu restricción explícita: tres casos de evasión en el oráculo, los tres siguen disparando — decidir citando un texto de apoyo, envolver el prompt entero para esconderse (lo salva el umbral que cierra ante evasión total), y decidir en español fuera de toda cita.
Y el oráculo se escribió primero y falló primero: 6/7 antes del arreglo, fallando justo el caso reproductor. Es la misma regla que metí ayer en el verificador de código — un test que no puede fallar no prueba nada — aplicada a mí mismo.