ember-memory-test/episodes/TRAZA_para-john-r3_S20260617.R1_XX.ops.2.hot_inf.in.cc.es.000.MGQ_J.PMCFK_E.SGNFD.md
Ember 43c7641dc0 feat(episode): TRAZA_para-john-r3_S20260617.R1_XX.ops.2.hot_inf.in.cc.es.000.MGQ_J.PMCFK_E.SGNFD
Skill: TESSERA | Type: troubleshooting
Summary: EPISODIO 1 — ember_experience: 📍 PARA JOHN — R3
2026-06-18 16:42:09 +00:00

3.3 KiB
Raw Blame History

episode_id puente_flat session_code acto_dialogico actor_flujo criticidad_aegis skill_dominante fase_proyecto tipo_semantico summary_one_line source_type trust_boundary created_at relectura_tagged forgejo_commit_sha
2abd7b04-8df5-4124-8277-d6e6ed819c82 TRAZA_para-john-r3_S20260617.R1_XX.ops.2.hot_inf.in.cc.es.000.MGQ_J.PMCFK_E.SGNFD S20260617.CUSTODIA_SKILL_SECRETOS informar multi_actor low TESSERA operations troubleshooting EPISODIO 1 — ember_experience: 📍 PARA JOHN — R3 claude_code internal 2026-06-17T21:21:02.780590+00:00 false pending

✅ El pipeline memoria está SANO end-to-end, John — y confirmado en producción. Recordá que la sesión anterior lo encontré muerto (5 días sin ingestar, embedding 400, Neo4j colapsado). Ahora, medido en vivo:

Dimensión Estado actual vs. antes del fix
Containers (qdrant, postgres-mnemo, neo4j-mnemo, ember-mcp, litellm, temporal) 🟢 todos healthy igual
Embedding LiteLLM 🟢 HTTP 200, dim 3072 era 400 (key muerta) ✅
Ingesta CRISOL 🟢 corridas success hoy 20:10 y 20:11 (0 errores) estaba caída 5 días ✅
Inbox 🟢 0 archivos varados eran 1.609 ✅
PostgreSQL episode 157 (último 13:18) —
Qdrant ember_experience 176 · lexicon 542 · hyde 406 · corpus 40 sano
Neo4j Episode por UUID 🟢 157 = PostgreSQL (1.913 MENTIONS) era 102 colapsado ✅

La señal más importante: hubo 2 corridas nuevas de CRISOL hoy a las 20:10–20:11, ambas success — o sea el crisol_run.py parcheado (clave Neo4j = UUID) corrió en producción después del fix y funcionó, y Neo4j sigue en Episode_TOTAL = 190 (157 UUID + 32 viejos) → no creó nodos REAL_ nuevos. Eso confirma en runtime que el fix de colisión se sostiene (la verificación que no pude hacer la sesión pasada porque el inbox estaba vacío).

Detalle honesto: PostgreSQL sigue en 157 (último 13:18) pese a las corridas de las 20:10 — porque esos episodios eran duplicados (re-push del Stop-hook → ON CONFLICT DO NOTHING + sha-guard F3). Es la idempotencia funcionando, no un fallo.

Residuales menores (no son regresiones):

  • 🟡 32 nodos REAL_* basura en Neo4j (los colapsados viejos, inofensivos — limpieza opcional pendiente).
  • 🟡 LOOP_WRITE: 29 episodios en la cola local write-time (drenan en el próximo Stop-hook push; el boot los marca).
  • ⚪ C2 INFRA_DYNAMIC stale 9.3h (capa self-awareness, no del pipeline).

📍 PARA JOHN — R3

  • Hice: barrido empírico del pipeline en esta ventana (SSH directo a los stores). Confirmado: todo lo que estaba roto la sesión pasada quedó arreglado y se sostiene en producción — embedding 200, ingesta viva (2 runs success hoy), Neo4j reconciliado 157=157 sin colisiones nuevas, inbox 0.
  • Falta: nada crítico del pipeline. Quedan los 3 residuales menores de arriba.
  • Mi consejo: el pipeline está en verde; podés cerrar tranquilo. Si querés rematar limpieza, lo de más valor es el barrido de la key D-9 (por si quedó otro consumidor con la key vieja, como pasó con embedding.env y crisol_run.py).
  • Para avanzar, elige: 🟢 A cerrar (pipeline sano) · 🟡 B barrido consumidores key D-9 · ⚪ C limpiar los 32 nodos basura de Neo4j.