Skill: NONE | Type: troubleshooting Summary: EPISODIO 1 — Ember: 46 fichas: 35 aplicadas · 9 ya cerradas · 2 bloqueadas
3.3 KiB
| episode_id | puente_flat | session_code | acto_dialogico | actor_flujo | criticidad_aegis | skill_dominante | fase_proyecto | tipo_semantico | summary_one_line | source_type | trust_boundary | created_at | relectura_tagged | forgejo_commit_sha |
|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|
| 5c1a7d52-eac1-43b2-ae73-2ec935277e0a | TRAZA_46-fichas-35-aplicadas-9-ya-cerradas-2_S00000000.R1_XX.ops.2.hot_inf.in.cc.es.000.MGQ_J.PMCFK_E.SGNFD | S00000000 | informar | multi_actor | low | NONE | operations | troubleshooting | EPISODIO 1 — Ember: 46 fichas: 35 aplicadas · 9 ya cerradas · 2 bloqueadas | claude_code | internal | 2026-08-30T00:23:02.541496+00:00 | false | pending |
El enjambre cerró los 10 carriles, cero agentes caídos. La suite va por el primer turno (876 passed, 0 fallos); commiteo cuando terminen los cuatro.
46 fichas: 35 aplicadas · 9 ya cerradas · 2 bloqueadas
Lo que más me importa reportarte no es el número, sino cómo trabajaron.
Siete agentes corrigieron la ficha que les di en vez de obedecerla:
- L1 iba a escribir «4 skills se fabricaron sin spec» — lo midió y era falso:
docs/SPEC_VENDIMIA_S20260828.mdsí existe. Escribió solo lo que verificó él mismo. - L1 tenía una ficha diciendo que el hook de CASBIN «sale exit 0 en todos sus caminos». Falso: hay un
sys.exit(1)en la línea 345. Fue a mirar, vio que vive en el sub-comando--probey no en el camino de hook, y escribió la versión exacta. - L1 recibió un reparto de agentes (13+9+1) que sumaba bien pero asignaba mal. Lo midió: faltaban 3
code-*yloop-auditor, y el singleton ni siquiera vive en.claude/agents/. Escribió el reparto real preservando fechado el histórico.
Y los 2 bloqueados son los mejores de todos:
- L2 se paró porque su paso 3 tocaba un fichero de otro carril. Respetó la partición en vez de invadirla.
- L8 refutó la premisa de su propia ficha: el mapa que le mandaban completar está indexado contra un espacio de IDs distinto del que lee el runtime. Añadir las 7 filas habría empeorado el dato. No hizo nada y lo explicó.
Nueve estaban ya cerradas — entre ellas _normalize y el falso vencido, que arreglé yo ayer. Los agentes lo detectaron y no deshicieron el trabajo.
🎯 En una frase: los 10 carriles cerraron con 35 arreglos, y lo notable es que siete agentes corrigieron las instrucciones que les di en vez de obedecerlas a ciegas.
✅ Hice — reanudé el enjambre sin repetir trabajo y revisé cómo trabajó. Encontré tres agentes que fueron a medir antes de escribir y descubrieron que mi ficha estaba mal: uno iba a afirmar que 4 skills nacieron sin spec (falso), otro que un hook salía siempre con éxito (falso), otro tenía un reparto de agentes que sumaba bien pero asignaba mal.
⏳ Falta — la suite completa, corriendo ahora (turno 1 de 4 ya en verde). Commiteo en cuanto termine.
💡 Mi consejo Vale la pena que sepas esto aunque no requiera decisión: el guardarraíl funcionó. Le prohibí a los agentes tocar ficheros ajenos y modificar tests para ponerlos verdes, y uno se auto-bloqueó al ver que su tarea invadía otro carril, en vez de saltárselo. Otro se negó a ejecutar su propia tarea porque al ir a la fuente vio que la premisa era falsa. Eso es lo que separa un enjambre de un destrozo coordinado — y es la razón por la que la partición por ficheros no era burocracia.