Skill: NONE | Type: chronicle Summary: EPISODIO 1 — MNEMO_PRE_DIGEST: Lo que Fable diseñó (plan gate PASS, 18.359 tok,
3.4 KiB
3.4 KiB
| episode_id | puente_flat | session_code | acto_dialogico | actor_flujo | criticidad_aegis | skill_dominante | fase_proyecto | tipo_semantico | summary_one_line | source_type | trust_boundary | created_at | relectura_tagged | forgejo_commit_sha |
|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|
| 0dcf26f4-f9e6-4c70-99cc-036e3b1929ae | TRAZA_lo-que-fable-dise-plan-gate-pass-18359-t_S20260718.R1_XX.ops.2.hot_inf.in.cc.es.000.MGQ_J.PMCFK_E.SGNFD | S20260718.ECC_TOOLBOX_SURFACER | informar | multi_actor | low | NONE | operations | chronicle | EPISODIO 1 — MNEMO_PRE_DIGEST: Lo que Fable diseñó (plan gate PASS, 18.359 tok, verificado | claude_code | internal | 2026-07-19T03:23:51.378628+00:00 | false | pending |
Loop completo. Actualicé el ledger del roadmap (DLC-9) para que ninguna instancia futura re-planee. Te entrego el resultado.
Lo que Fable diseñó (plan gate PASS, 18.359 tok, verificado sustantivo)
[R2.seccion1.L1] 17 tareas, 3 fases (común → 5 auditorías M1/M2 → síntesis+PROBATOR). Las decisiones fuertes de Fable — el pensamiento insustituible que compramos con el briefing barato:
- Cero LLM-juez. Los 5 experimentos M2 usan oráculos mecánicos (etiquetas CURE para COMPASS/ALQUIMIA, resolución de citas para PROCEDENCIA, recall vectorial ciego para TESSERA, aritmética de transcripts para GAUGE). Elimina la circularidad "el mismo Opus se juzga" por construcción, no por buena fe.
- 5 brazos por protocolo (ej. COMPASS: A0 router determinista → A1 Opus-bare → A2 Haiku-bare → A3 Haiku+doctrina → A4 Opus+doctrina), con McNemar pareado. Brazo débil (Haiku/Sonnet) obligatorio en los 5 — porque FORENSE dañó a Haiku, el juicio real es sobre el ejecutor débil, no sobre Opus.
- Brazo LITE de 1 línea donde el protocolo es prosa (PROCEDENCIA, TESSERA): testea SIMPLIFICAR directo (precedente FORENSE→FORENSE-LITE).
- El costo entra al veredicto. Mide beneficio menos costo (tokens residentes al boot + overhead runtime + inflación de output). "Gana su costo" exige los dos platillos.
- Estadística pre-registrada (McNemar + bootstrap CI95, N y umbrales fijados ANTES de ver datos = anti p-hacking). Regla de techo: eje del steelman sin medir → veredicto máximo de castigo = SIMPLIFICAR, nunca RETIRAR con evidencia incompleta.
- Sandbox reversible (
scripts/audit_wave1/, coleccionesaudit_tessera_*), read-only sobre los 5 protocolos verificado por oráculo finalgit diffvacío.
Entregables (los 3 artefactos)
| Artefacto | Ruta | Gate |
|---|---|---|
| Briefing SHERPA (mochila para Fable) | BRIEFING_S20260718_auditoria_protocolos_wave1.md | --package PASS · 8.930 tok |
| Plan de Fable (el pensamiento) | PLAN_FABLE_S20260718_auditoria_protocolos_wave1.md | --plan PASS · 17 tareas |
| Ledger sincronizado | ROADMAP_AUDITORIA_PROTOCOLOS_S20260711.md | Wave 1 → 📋 PLAN LISTO |
3 GO-John que el plan pre-clasificó (ninguno bloquea la fase común): DP-1 gasto API externo >$0 (solo si los subagentes nativos Haiku/Sonnet no bastan) · DP-2 aplicar veredictos editando CLAUDE.md/rules/hooks (es el paso 6 post-auditoría, fuera de este plan) · DP-3 borrar vs retener las colecciones audit_tessera_*.
Dime A / B / C y sigo. Mi recomendación es A.