Skill: NEXUS | Type: troubleshooting Summary: EPISODIO 14 — BLINDADAS: Los tres diseños externos: buen rumbo, mismos pecados
2.5 KiB
2.5 KiB
| episode_id | puente_flat | session_code | acto_dialogico | actor_flujo | criticidad_aegis | skill_dominante | fase_proyecto | tipo_semantico | summary_one_line | source_type | trust_boundary | created_at | relectura_tagged | forgejo_commit_sha |
|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|
| e3ad8ac1-4996-44ba-8e1f-68cc0afe172d | EXPLORA_los-tres-diseos-externos-buen-rumbo-mism_S20260705.R14_XX.ops.2.hot_inf.in.cc.es.000.MGQ_J.PMCFK_E.SGNFD | S20260705.EVAL_INSTRUMENT_FORGE_SKILL | informar | multi_actor | low | NEXUS | operations | troubleshooting | EPISODIO 14 — BLINDADAS: Los tres diseños externos: buen rumbo, mismos pecados | claude_code | internal | 2026-07-12T16:18:39.187306+00:00 | false | pending |
Los tres diseños externos: buen rumbo, mismos pecados
Commit 725f6cd, push 3/3. docs/TRIAJE_DISENOS_EXTERNOS_RELOJERO_V2_S20260705.md. John, verifiqué en vivo antes de opinar, y el resultado es limpio: estos tres diseños no superan al RELOJERO-v2 que ya construimos — son su versión sin verificar, sin escalonar y sin auditar.
Lo bueno: convergen
Los 3 externos + mi v2 + las 4 opiniones + las 5 investigaciones apuntan al mismo núcleo: verificación externa, least-privilege, receipts, escalonar. Cinco caminos independientes al mismo lugar — el rumbo está sólido, y eso vale. ## Lo malo: repiten los 4 pecados que mi workflow ya atrapó
- Bloat universal. Aplican 5 pilares pesados (sandbox + red-team + fuzzing + receipt firmado + contrato) a toda generación de código. El paper de ETH (2602.11988) y mi AB-LAB prueban que eso baja el éxito y sube el costo >20%. Ninguno escalona. Mi v2 sí (LITE por defecto = cero ceremonia). 2. Herramientas fantasma (verificado en vivo):
- garak → lo citan como
leonardovolker/garakcon una APIfuzz.Fuzzer(codigo). Real es NVIDIA/garak, y escanea LLMs, no fuzzea código. La API está inventada. - LLM Guard → lo citan comoGuardrailsAI/llm-guardcon unRedTeamAgentque "ataca código". Real es protectai/llm-guard, un firewall de prompts, sin ese API. - AgentForge → sigue sin verificarse (arrastra los enlacesmorphllm.comalucinados). 3. El juez sobornable, de vuelta. Su "verificador externo" estrella es DeepEval, que es un LLM juzgando a otro LLM — y el ejemplo compara el archivo consigo mismo (expected == actual), o sea siempre pasa. Es literalmente el fallo 4b ("2.7M verde" auto-confirmado) re-instanciado.
- garak → lo citan como