ember-memory-test/episodes/EXPLORA_los-tres-diseos-externos-buen-rumbo-mism_S20260705.R14_XX.ops.2.hot_inf.in.cc.es.000.MGQ_J.PMCFK_E.SGNFD.md
Ember 59ec0b8f02 feat(episode): EXPLORA_los-tres-diseos-externos-buen-rumbo-mism_S20260705.R14_XX.ops.2.hot_inf.in.cc.es.000.MGQ_J.PMCFK_E.SGNFD
Skill: NEXUS | Type: troubleshooting
Summary: EPISODIO 14 — BLINDADAS: Los tres diseños externos: buen rumbo, mismos pecados
2026-07-12 16:31:19 +00:00

2.5 KiB

episode_id puente_flat session_code acto_dialogico actor_flujo criticidad_aegis skill_dominante fase_proyecto tipo_semantico summary_one_line source_type trust_boundary created_at relectura_tagged forgejo_commit_sha
e3ad8ac1-4996-44ba-8e1f-68cc0afe172d EXPLORA_los-tres-diseos-externos-buen-rumbo-mism_S20260705.R14_XX.ops.2.hot_inf.in.cc.es.000.MGQ_J.PMCFK_E.SGNFD S20260705.EVAL_INSTRUMENT_FORGE_SKILL informar multi_actor low NEXUS operations troubleshooting EPISODIO 14 — BLINDADAS: Los tres diseños externos: buen rumbo, mismos pecados claude_code internal 2026-07-12T16:18:39.187306+00:00 false pending

Los tres diseños externos: buen rumbo, mismos pecados

Commit 725f6cd, push 3/3. docs/TRIAJE_DISENOS_EXTERNOS_RELOJERO_V2_S20260705.md. John, verifiqué en vivo antes de opinar, y el resultado es limpio: estos tres diseños no superan al RELOJERO-v2 que ya construimos — son su versión sin verificar, sin escalonar y sin auditar.

Lo bueno: convergen

Los 3 externos + mi v2 + las 4 opiniones + las 5 investigaciones apuntan al mismo núcleo: verificación externa, least-privilege, receipts, escalonar. Cinco caminos independientes al mismo lugar — el rumbo está sólido, y eso vale. ## Lo malo: repiten los 4 pecados que mi workflow ya atrapó

  1. Bloat universal. Aplican 5 pilares pesados (sandbox + red-team + fuzzing + receipt firmado + contrato) a toda generación de código. El paper de ETH (2602.11988) y mi AB-LAB prueban que eso baja el éxito y sube el costo >20%. Ninguno escalona. Mi v2 sí (LITE por defecto = cero ceremonia). 2. Herramientas fantasma (verificado en vivo):
    • garak → lo citan como leonardovolker/garak con una API fuzz.Fuzzer(codigo). Real es NVIDIA/garak, y escanea LLMs, no fuzzea código. La API está inventada. - LLM Guard → lo citan como GuardrailsAI/llm-guard con un RedTeamAgent que "ataca código". Real es protectai/llm-guard, un firewall de prompts, sin ese API. - AgentForge → sigue sin verificarse (arrastra los enlaces morphllm.com alucinados). 3. El juez sobornable, de vuelta. Su "verificador externo" estrella es DeepEval, que es un LLM juzgando a otro LLM — y el ejemplo compara el archivo consigo mismo (expected == actual), o sea siempre pasa. Es literalmente el fallo 4b ("2.7M verde" auto-confirmado) re-instanciado.