ember-memory-test/episodes/TRAZA_46-fichas-35-aplicadas-9-ya-cerradas-2_S00000000.R1_XX.ops.2.hot_inf.in.cc.es.000.MGQ_J.PMCFK_E.SGNFD.md
Ember 7ebcd26d08 feat(episode): TRAZA_46-fichas-35-aplicadas-9-ya-cerradas-2_S00000000.R1_XX.ops.2.hot_inf.in.cc.es.000.MGQ_J.PMCFK_E.SGNFD
Skill: NONE | Type: troubleshooting
Summary: EPISODIO 1 — Ember: 46 fichas: 35 aplicadas · 9 ya cerradas · 2 bloqueadas
2026-08-30 00:23:12 +00:00

3.3 KiB

episode_id puente_flat session_code acto_dialogico actor_flujo criticidad_aegis skill_dominante fase_proyecto tipo_semantico summary_one_line source_type trust_boundary created_at relectura_tagged forgejo_commit_sha
5c1a7d52-eac1-43b2-ae73-2ec935277e0a TRAZA_46-fichas-35-aplicadas-9-ya-cerradas-2_S00000000.R1_XX.ops.2.hot_inf.in.cc.es.000.MGQ_J.PMCFK_E.SGNFD S00000000 informar multi_actor low NONE operations troubleshooting EPISODIO 1 — Ember: 46 fichas: 35 aplicadas · 9 ya cerradas · 2 bloqueadas claude_code internal 2026-08-30T00:23:02.541496+00:00 false pending

El enjambre cerró los 10 carriles, cero agentes caídos. La suite va por el primer turno (876 passed, 0 fallos); commiteo cuando terminen los cuatro.

46 fichas: 35 aplicadas · 9 ya cerradas · 2 bloqueadas

Lo que más me importa reportarte no es el número, sino cómo trabajaron.

Siete agentes corrigieron la ficha que les di en vez de obedecerla:

  • L1 iba a escribir «4 skills se fabricaron sin spec» — lo midió y era falso: docs/SPEC_VENDIMIA_S20260828.md sí existe. Escribió solo lo que verificó él mismo.
  • L1 tenía una ficha diciendo que el hook de CASBIN «sale exit 0 en todos sus caminos». Falso: hay un sys.exit(1) en la línea 345. Fue a mirar, vio que vive en el sub-comando --probe y no en el camino de hook, y escribió la versión exacta.
  • L1 recibió un reparto de agentes (13+9+1) que sumaba bien pero asignaba mal. Lo midió: faltaban 3 code-* y loop-auditor, y el singleton ni siquiera vive en .claude/agents/. Escribió el reparto real preservando fechado el histórico.

Y los 2 bloqueados son los mejores de todos:

  • L2 se paró porque su paso 3 tocaba un fichero de otro carril. Respetó la partición en vez de invadirla.
  • L8 refutó la premisa de su propia ficha: el mapa que le mandaban completar está indexado contra un espacio de IDs distinto del que lee el runtime. Añadir las 7 filas habría empeorado el dato. No hizo nada y lo explicó.

Nueve estaban ya cerradas — entre ellas _normalize y el falso vencido, que arreglé yo ayer. Los agentes lo detectaron y no deshicieron el trabajo.

🎯 En una frase: los 10 carriles cerraron con 35 arreglos, y lo notable es que siete agentes corrigieron las instrucciones que les di en vez de obedecerlas a ciegas.

Hice — reanudé el enjambre sin repetir trabajo y revisé cómo trabajó. Encontré tres agentes que fueron a medir antes de escribir y descubrieron que mi ficha estaba mal: uno iba a afirmar que 4 skills nacieron sin spec (falso), otro que un hook salía siempre con éxito (falso), otro tenía un reparto de agentes que sumaba bien pero asignaba mal.

Falta — la suite completa, corriendo ahora (turno 1 de 4 ya en verde). Commiteo en cuanto termine.

💡 Mi consejo Vale la pena que sepas esto aunque no requiera decisión: el guardarraíl funcionó. Le prohibí a los agentes tocar ficheros ajenos y modificar tests para ponerlos verdes, y uno se auto-bloqueó al ver que su tarea invadía otro carril, en vez de saltárselo. Otro se negó a ejecutar su propia tarea porque al ir a la fuente vio que la premisa era falsa. Eso es lo que separa un enjambre de un destrozo coordinado — y es la razón por la que la partición por ficheros no era burocracia.