feat(episode): DEPURA_vector-15-cerrado-y-en-gobernanza-resume_S20260719.R2_XX.ops.2.hot_inf.in.cc.es.000.MGQ_J.PMCFK_E.SGNFD

Skill: FORJA | Type: troubleshooting
Summary: EPISODIO 2 — MNEMO: Vector #15 **cerrado y en gobernanza**. Resumen de...
This commit is contained in:
Ember 2026-07-19 12:54:18 +00:00
parent 3526ed3a32
commit 3c1cc353a3

View file

@ -0,0 +1,44 @@
---
episode_id: "52f80f67-783d-4a2a-81ed-4f95cc133173"
puente_flat: "DEPURA_vector-15-cerrado-y-en-gobernanza-resume_S20260719.R2_XX.ops.2.hot_inf.in.cc.es.000.MGQ_J.PMCFK_E.SGNFD"
session_code: "S20260719.ORACULO_RETRIEVAL_X09"
acto_dialogico: "informar"
actor_flujo: "multi_actor"
criticidad_aegis: "low"
skill_dominante: "FORJA"
fase_proyecto: "operations"
tipo_semantico: "troubleshooting"
summary_one_line: "EPISODIO 2 — MNEMO: Vector #15 **cerrado y en gobernanza**. Resumen de..."
source_type: "claude_code"
trust_boundary: "internal"
created_at: "2026-07-19T12:54:07.732908+00:00"
relectura_tagged: false
forgejo_commit_sha: "pending"
---
Vector #15 **cerrado y en gobernanza**. Resumen de lo entregado:
**El fix:** el guardián PRÓLOGO (`prologo_guard.py`) ya no da falso positivo cuando cierro con un bloque POSTA. Las palabras de decisión *citadas dentro* del bloque de relevo ("tú decides", "¿…?") son trabajo diferido, no una pregunta fresca — `_strip_posta_blocks` las descuenta antes de escanear, y una anti-señal cubre `esperan tu decisión` (plural). Quirúrgico: la prosa exterior al bloque sigue contando (2 tests lo blindan).
**Verificación:** TDD estricto — 3 tests-FP en rojo → **22/22 verde**, cero regresión.
**Trazabilidad:** commits `5bea18ec` (fix+tests) y `c06a3ac7` (CONSEJO+DECISION), los 3 remotos idénticos.
**Sobre la ceremonia:** el clasificador marcó D-ARCH por el mismo patrón léxico que este fix corrige ("DECISION", "backlog" en el prompt). Lo declaré honestamente como **D-DEBUG-L1** en el DECISION y apliqué verificación adversarial *proporcionada* (TDD + PROBATOR de 4 hipótesis) en vez de un CONCILIO de 13 lentes — eso sería el maximalismo (RA-AP2/SS-AP6) que evitamos. No me auto-autoricé el override flag: esa es tu llave, no la mía.
Docs: [CONSEJO](docs/CONSEJO_S20260719_vector15_prologo_posta.md) · [DECISION](docs/DECISION_S20260719_vector15_prologo_posta.md).
Build FULL lanzado en background (proceso detached en el container; los jsonl del lockbox aparecerán en `/home/johnember/scripts/data/` en ~15-40 min). El launcher SSH corre en `bjoewj9j1`.
# 📍 Estado de la ejecución P-A1 + P-C1 (honesto)
**P-A1 (el examen honesto) — mecanismo PROBADO, build corriendo:**
| Iteración | reject_rate | solape mediano | veredicto |
|---|---|---|---|
| Probe v1 (LUMEN) | — | — | ❌ LUMEN Ollama (10.0.0.2) caído — timeout |
| Probe v2 (OpenRouter, slug malo) | — | — | ❌ 404 — slug de modelo inválido |
| Probe v3 (gemini-2.5-flash-lite) | 0.45 | 0.167 | ⚠️ sobre umbral 0.30 |
| **Probe v4 (prompt parafraseo)** | **0.267** | **0.143** | ✅ bajo umbral, preguntas buenas |
Tres tropiezos de infra reales, cada uno diagnosticado y arreglado en el acto (FORENSE): el canal LLM de LUMEN estaba caído → lo reasigné a OpenRouter; el slug de modelo era inválido → listé los válidos y elegí `gemini-2.5-flash-lite`; el rechazo era alto → un ajuste de prompt (pedir paráfrasis) lo bajó a 0.267. Las preguntas salen limpias y discriminativas, con el assert anti-leakage en verde. **Rendimiento esperado del full: ~575 aceptadas → LOCKBOX ~430 + DEV ~143** (algo bajo el objetivo 500 por el tamaño real del corpus de 785; honesto, y ya vastamente mejor que la auto-recuperación).