Skill: NONE | Type: troubleshooting Summary: EPISODIO 5 — Prompt Injection: La respuesta del millón (honesta, con evidencia)
3.7 KiB
| episode_id | puente_flat | session_code | acto_dialogico | actor_flujo | criticidad_aegis | skill_dominante | fase_proyecto | tipo_semantico | summary_one_line | source_type | trust_boundary | created_at | relectura_tagged | forgejo_commit_sha |
|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|
| aacbcfda-84de-4636-80cd-a3cadcb6dd36 | TRAZA_la-respuesta-del-milln-honesta-con-evide_S20260602.R5_XX.ops.2.hot_inf.in.cc.es.000.MGQ_J.PMCFK_E.SGNFD | S20260602.GRAFO_GRAPHIFY_CURADURIA | informar | multi_actor | low | NONE | operations | troubleshooting | EPISODIO 5 — Prompt Injection: La respuesta del millón (honesta, con evidencia) | claude_code | internal | 2026-06-02T18:14:25.311192+00:00 | false | pending |
📄 Snapshot persistido: ESTADO_AGENTES_S20260602.md — incluye la auditoría spec-kit.
La respuesta del millón (honesta, con evidencia)
Fuiste clarísimo. Y la respuesta corta es: NO — hoy los agentes NO siguen uniformemente los patrones de comportamiento del spec-kit. Cumplen Casbin (gobernanza), hacen sus tareas típicas, pero el spec-kit como directriz de comportamiento transversal solo está en uno de los 23.
Distingamos las tres capas para que quede nítido:
| Capa | Qué impone | ¿Cableada en los 23 agentes? |
|---|---|---|
| Tareas típicas | qué hace cada agente | ✅ sí (es su definición) |
| Casbin (gobernanza) | qué le está permitido hacer | ✅ sí — los 23 en el CSV |
| spec-kit (metodología) | cómo construir bien (constitution + spec→plan→tasks + EARS) | ⚠️ NO uniforme — solo code-architect |
La evidencia (verificada hoy):
Grepde EARS/spec-kit/specs/ en los 22 archivos de agente → solocode-architectlo referencia (él produce la fase "specify": EARS +requirements.md+design.md). Los otros 21: cero.- El spec-kit sí existe y es rico, pero a nivel proyecto:
specs/proyecto-memoria-ember/conconstitution.md(C1-C16) + ~20 features en spec→plan→tasks. Es la metodología que tú y yo seguimos al construir features con/speckit, no algo que cada agente respire.
El porqué estructural (esto es lo importante): un subagente nativo de Claude Code recibe como su único system prompt su archivo .claude/agents/<n>.md — no hereda CLAUDE.md, ni rules/, ni BLINDADAS, ni el spec-kit. Lo que no esté escrito dentro del archivo del agente, el subagente sencillamente no lo sigue. Por eso code-author sí respira RELOJERO (lo tiene escrito), pero ninguno respira spec-kit salvo code-architect.
Conclusión: tu intuición apunta a un gap arquitectónico real. El pipeline RELOJERO (architect→author→verifier→reviewer→validator) imita el flujo spec-kit (spec→plan→implement→verify), pero no hay un mecanismo que obligue a todos los agentes a operar bajo la constitution + los gates EARS del spec-kit en cualquier tarea.
Cablearlo (inyectar constitution + spec-kit gates en el comportamiento de los 23) sería una decisión D-ARCH de blast radius alto → merece su propio sprint con CONCILIO, no improvisarlo al cierre. Es exactamente el tipo de cosa que NO debo hacer a las apuradas.
¿Quieres que lo deje planteado como propuesta de sprint ("Cablear spec-kit como capa de comportamiento transversal en los 23 agentes") en el HANDOFF/CIERRE para abrirlo con CONCILIO en una próxima ventana? Y aparte, ¿corrijo el drift menor de comentarios del CSV Casbin (dice 20, real 23) antes de cerrar?
📁 BITÁCORA S20260602.GRAFO_GRAPHIFY_CURADURIA:
🔍 SEARCH Grep spec-kit/EARS en .claude/agents → solo code-architect · Grep behavioral_mindset → 0 · Glob specs/** (constitution + ~20 features)
🆕 WRITE docs/ESTADO_AGENTES_S20260602.md (snapshot 23 roles + auditoría spec-kit)