ember-memory-test/episodes/TRAZA_la-respuesta-del-milln-honesta-con-evide_S20260602.R5_XX.ops.2.hot_inf.in.cc.es.000.MGQ_J.PMCFK_E.SGNFD.md
Ember aebcd64fe2 feat(episode): TRAZA_la-respuesta-del-milln-honesta-con-evide_S20260602.R5_XX.ops.2.hot_inf.in.cc.es.000.MGQ_J.PMCFK_E.SGNFD
Skill: NONE | Type: troubleshooting
Summary: EPISODIO 5 — Prompt Injection: La respuesta del millón (honesta, con evidencia)
2026-06-02 18:15:38 +00:00

3.7 KiB

episode_id puente_flat session_code acto_dialogico actor_flujo criticidad_aegis skill_dominante fase_proyecto tipo_semantico summary_one_line source_type trust_boundary created_at relectura_tagged forgejo_commit_sha
aacbcfda-84de-4636-80cd-a3cadcb6dd36 TRAZA_la-respuesta-del-milln-honesta-con-evide_S20260602.R5_XX.ops.2.hot_inf.in.cc.es.000.MGQ_J.PMCFK_E.SGNFD S20260602.GRAFO_GRAPHIFY_CURADURIA informar multi_actor low NONE operations troubleshooting EPISODIO 5 — Prompt Injection: La respuesta del millón (honesta, con evidencia) claude_code internal 2026-06-02T18:14:25.311192+00:00 false pending

📄 Snapshot persistido: ESTADO_AGENTES_S20260602.md — incluye la auditoría spec-kit.

La respuesta del millón (honesta, con evidencia)

Fuiste clarísimo. Y la respuesta corta es: NO — hoy los agentes NO siguen uniformemente los patrones de comportamiento del spec-kit. Cumplen Casbin (gobernanza), hacen sus tareas típicas, pero el spec-kit como directriz de comportamiento transversal solo está en uno de los 23.

Distingamos las tres capas para que quede nítido:

Capa Qué impone ¿Cableada en los 23 agentes?
Tareas típicas qué hace cada agente sí (es su definición)
Casbin (gobernanza) qué le está permitido hacer sí — los 23 en el CSV
spec-kit (metodología) cómo construir bien (constitution + spec→plan→tasks + EARS) ⚠️ NO uniforme — solo code-architect

La evidencia (verificada hoy):

  • Grep de EARS/spec-kit/specs/ en los 22 archivos de agente → solo code-architect lo referencia (él produce la fase "specify": EARS + requirements.md + design.md). Los otros 21: cero.
  • El spec-kit sí existe y es rico, pero a nivel proyecto: specs/proyecto-memoria-ember/ con constitution.md (C1-C16) + ~20 features en spec→plan→tasks. Es la metodología que tú y yo seguimos al construir features con /speckit, no algo que cada agente respire.

El porqué estructural (esto es lo importante): un subagente nativo de Claude Code recibe como su único system prompt su archivo .claude/agents/<n>.mdno hereda CLAUDE.md, ni rules/, ni BLINDADAS, ni el spec-kit. Lo que no esté escrito dentro del archivo del agente, el subagente sencillamente no lo sigue. Por eso code-author sí respira RELOJERO (lo tiene escrito), pero ninguno respira spec-kit salvo code-architect.

Conclusión: tu intuición apunta a un gap arquitectónico real. El pipeline RELOJERO (architect→author→verifier→reviewer→validator) imita el flujo spec-kit (spec→plan→implement→verify), pero no hay un mecanismo que obligue a todos los agentes a operar bajo la constitution + los gates EARS del spec-kit en cualquier tarea.

Cablearlo (inyectar constitution + spec-kit gates en el comportamiento de los 23) sería una decisión D-ARCH de blast radius alto → merece su propio sprint con CONCILIO, no improvisarlo al cierre. Es exactamente el tipo de cosa que NO debo hacer a las apuradas.

¿Quieres que lo deje planteado como propuesta de sprint ("Cablear spec-kit como capa de comportamiento transversal en los 23 agentes") en el HANDOFF/CIERRE para abrirlo con CONCILIO en una próxima ventana? Y aparte, ¿corrijo el drift menor de comentarios del CSV Casbin (dice 20, real 23) antes de cerrar?

📁 BITÁCORA S20260602.GRAFO_GRAPHIFY_CURADURIA: 🔍 SEARCH Grep spec-kit/EARS en .claude/agents → solo code-architect · Grep behavioral_mindset → 0 · Glob specs/** (constitution + ~20 features) 🆕 WRITE docs/ESTADO_AGENTES_S20260602.md (snapshot 23 roles + auditoría spec-kit)