feat(episode): TRAZA_este-result-peor-de-lo-anunciado_S20260812.R5_XX.ops.2.hot_inf.in.cc.es.000.MGQ_J.PMCFK_E.SGNFD

Skill: NONE | Type: troubleshooting
Summary: EPISODIO 5 — MNEMO_PRE_DIGEST: Este resultó peor de lo anunciado
This commit is contained in:
Ember 2026-08-14 04:27:07 +00:00
parent e9c8a45f4c
commit 0fffe5cac6

View file

@ -0,0 +1,46 @@
---
episode_id: "3b2039b5-bfb3-4150-a063-fb68c4baa63e"
puente_flat: "TRAZA_este-result-peor-de-lo-anunciado_S20260812.R5_XX.ops.2.hot_inf.in.cc.es.000.MGQ_J.PMCFK_E.SGNFD"
session_code: "S20260812.PIPELINE_FIXES"
acto_dialogico: "informar"
actor_flujo: "multi_actor"
criticidad_aegis: "low"
skill_dominante: "NONE"
fase_proyecto: "operations"
tipo_semantico: "troubleshooting"
summary_one_line: "EPISODIO 5 — MNEMO_PRE_DIGEST: Este resultó peor de lo anunciado"
source_type: "claude_code"
trust_boundary: "internal"
created_at: "2026-08-14T04:26:38.838481+00:00"
relectura_tagged: false
forgejo_commit_sha: "pending"
---
Hecho y respaldado (`0c28330f`).
## Este resultó peor de lo anunciado
El barrido decía "mide vocabulario en vez del hecho". Al ejecutarlo apareció algo distinto: **el sello sobrevivía a su propia negación.**
| Texto | Sello (antes) |
|---|---|
| *"Esto **NO** está verificado: hay que comprobarlo"* | `VERIFIED` |
| *"Listo ✅ ya quedó el cambio"* | `VERIFIED` |
| *"22 de 40 episodios: 0.55 frente al umbral 0.80"* | `MIXED` |
Un episodio que **declara explícitamente no estar verificado** se guardaba como verificado. Y el contraste que lo retrata: **un emoji decorativo puntuaba más alto que una medición con cifras**.
**Separé dos cosas a propósito**, porque no me corresponden igual:
- **El bug lo arreglé:** la negación explícita ya impide el sello máximo. No inventa desconfianza — solo bloquea `VERIFIED`. Un sello que sobrevive a su negación no es una decisión de diseño, es un error.
- **El diseño lo declaré, no lo cambié:** que la confianza se calcule contando palabras es la lógica vigente y cambiarla es tuya. Ahora el payload lleva `trust_level_source: "vocabulario_regex"`, para que ningún consumidor lea ese sello como si fuera una medición.
Los tests incluyen **evasiones** siguiendo tu lección: negación con tilde y sin, negación junto a un ✅, perífrasis como "queda por confirmar". Más tres anti-falso-positivo, porque estrechar un detector puede dejarlo inútil — si la verificación real deja de sellar, se ponen rojos. Mordida comprobada: vaciando la lista, 3 de 3 negaciones vuelven a sellar.
**276 tests verdes.**
**Hice.** El sistema ya no puede guardar como "verificado" un episodio que dice explícitamente que no lo está. Y donde no me correspondía decidir —que la confianza se mida contando palabras— lo dejé funcionando igual pero **declarado**, para que nadie lo confunda con una medición.
**Falta.** El siguiente es el que hace que tu auditor de calidad apruebe defaults: la prueba de que una etiqueta *no* hizo match se calcula y se tira a la basura.
**Mi consejo.** Sigo con ese y cierro el frente. Después conviene consolidar todo lo de hoy en un documento, porque son cinco frentes y merece quedar contado en un sitio.