ember-memory-test/episodes/TRAZA_lo-que-fable-dise-plan-gate-pass-18359-t_S20260718.R1_XX.ops.2.hot_inf.in.cc.es.000.MGQ_J.PMCFK_E.SGNFD.md
Ember 1965a1a189 feat(episode): TRAZA_lo-que-fable-dise-plan-gate-pass-18359-t_S20260718.R1_XX.ops.2.hot_inf.in.cc.es.000.MGQ_J.PMCFK_E.SGNFD
Skill: NONE | Type: chronicle
Summary: EPISODIO 1 — MNEMO_PRE_DIGEST: Lo que Fable diseñó (plan gate PASS, 18.359 tok,
2026-07-19 03:23:52 +00:00

3.4 KiB

episode_id puente_flat session_code acto_dialogico actor_flujo criticidad_aegis skill_dominante fase_proyecto tipo_semantico summary_one_line source_type trust_boundary created_at relectura_tagged forgejo_commit_sha
0dcf26f4-f9e6-4c70-99cc-036e3b1929ae TRAZA_lo-que-fable-dise-plan-gate-pass-18359-t_S20260718.R1_XX.ops.2.hot_inf.in.cc.es.000.MGQ_J.PMCFK_E.SGNFD S20260718.ECC_TOOLBOX_SURFACER informar multi_actor low NONE operations chronicle EPISODIO 1 — MNEMO_PRE_DIGEST: Lo que Fable diseñó (plan gate PASS, 18.359 tok, verificado claude_code internal 2026-07-19T03:23:51.378628+00:00 false pending

Loop completo. Actualicé el ledger del roadmap (DLC-9) para que ninguna instancia futura re-planee. Te entrego el resultado.

Lo que Fable diseñó (plan gate PASS, 18.359 tok, verificado sustantivo)

[R2.seccion1.L1] 17 tareas, 3 fases (común → 5 auditorías M1/M2 → síntesis+PROBATOR). Las decisiones fuertes de Fable — el pensamiento insustituible que compramos con el briefing barato:

  • Cero LLM-juez. Los 5 experimentos M2 usan oráculos mecánicos (etiquetas CURE para COMPASS/ALQUIMIA, resolución de citas para PROCEDENCIA, recall vectorial ciego para TESSERA, aritmética de transcripts para GAUGE). Elimina la circularidad "el mismo Opus se juzga" por construcción, no por buena fe.
  • 5 brazos por protocolo (ej. COMPASS: A0 router determinista → A1 Opus-bare → A2 Haiku-bare → A3 Haiku+doctrina → A4 Opus+doctrina), con McNemar pareado. Brazo débil (Haiku/Sonnet) obligatorio en los 5 — porque FORENSE dañó a Haiku, el juicio real es sobre el ejecutor débil, no sobre Opus.
  • Brazo LITE de 1 línea donde el protocolo es prosa (PROCEDENCIA, TESSERA): testea SIMPLIFICAR directo (precedente FORENSE→FORENSE-LITE).
  • El costo entra al veredicto. Mide beneficio menos costo (tokens residentes al boot + overhead runtime + inflación de output). "Gana su costo" exige los dos platillos.
  • Estadística pre-registrada (McNemar + bootstrap CI95, N y umbrales fijados ANTES de ver datos = anti p-hacking). Regla de techo: eje del steelman sin medir → veredicto máximo de castigo = SIMPLIFICAR, nunca RETIRAR con evidencia incompleta.
  • Sandbox reversible (scripts/audit_wave1/, colecciones audit_tessera_*), read-only sobre los 5 protocolos verificado por oráculo final git diff vacío.

Entregables (los 3 artefactos)

Artefacto Ruta Gate
Briefing SHERPA (mochila para Fable) BRIEFING_S20260718_auditoria_protocolos_wave1.md --package PASS · 8.930 tok
Plan de Fable (el pensamiento) PLAN_FABLE_S20260718_auditoria_protocolos_wave1.md --plan PASS · 17 tareas
Ledger sincronizado ROADMAP_AUDITORIA_PROTOCOLOS_S20260711.md Wave 1 → 📋 PLAN LISTO

3 GO-John que el plan pre-clasificó (ninguno bloquea la fase común): DP-1 gasto API externo >$0 (solo si los subagentes nativos Haiku/Sonnet no bastan) · DP-2 aplicar veredictos editando CLAUDE.md/rules/hooks (es el paso 6 post-auditoría, fuera de este plan) · DP-3 borrar vs retener las colecciones audit_tessera_*.

Dime A / B / C y sigo. Mi recomendación es A.