ember-memory-test/episodes/TRAZA_lo-que-el-probe-encontr-todo-con-evidenc_S20260601.R50_XX.ops.2.hot_inf.in.cc.es.000.MGQ_J.PMCFK_E.SGNFD.md
Ember eeff77411b feat(episode): TRAZA_lo-que-el-probe-encontr-todo-con-evidenc_S20260601.R50_XX.ops.2.hot_inf.in.cc.es.000.MGQ_J.PMCFK_E.SGNFD
Skill: NONE | Type: troubleshooting
Summary: EPISODIO 50 — BLINDADAS: Lo que el probe encontró (todo con evidencia empírica e
2026-06-02 19:51:05 +00:00

2.5 KiB

episode_id puente_flat session_code acto_dialogico actor_flujo criticidad_aegis skill_dominante fase_proyecto tipo_semantico summary_one_line source_type trust_boundary created_at relectura_tagged forgejo_commit_sha
203ea7a1-5642-4db8-92ef-b5b4df41d7fa TRAZA_lo-que-el-probe-encontr-todo-con-evidenc_S20260601.R50_XX.ops.2.hot_inf.in.cc.es.000.MGQ_J.PMCFK_E.SGNFD S20260601.LUMEN_CAPACIDAD_LLM_LIGERO informar multi_actor low NONE operations troubleshooting EPISODIO 50 — BLINDADAS: Lo que el probe encontró (todo con evidencia empírica este t claude_code internal 2026-06-02T19:49:46.641811+00:00 false pending

Probe completo — veredicto entregado: docs/PROBE_LUMEN_CAPACIDAD_S20260601.md. Tu razonamiento era correcto y la verificación pagó: descubrimos que el pipeline no era el problema — la herramienta sí.

Lo que el probe encontró (todo con evidencia empírica este turno)

Pregunta Respuesta
¿LUMEN soporta una función en el pipeline? — Qwen2.5-Coder-14B vivo, JSON perfecto, clasificó FP correctamente (= gold-set JAE)
¿Qué función? Batch/async de clasificación-extracción (defect-signals JAE, HyDE, pre-digest). NO online (7.8 tok/s)
¿Por qué fallaba lumen_generate? Tool rota: usa SSH:22 (caído) + pide lumen-v4/QwQ-32B que no está cargado (lo real es qwen2.5-coder)

La inversión clave que validaste

Si hubiéramos "arreglado el pipeline" primero, habríamos construido sobre una tool rota y un modelo equivocado. Verificar capacidad primero reveló que LUMEN está sano — lo roto es el conector MCP + un drift de modelo (boot dice QwQ-32B, realidad qwen2.5-coder). Tu orden de pensar evitó horas de FORENSE mal dirigido.

Función candidata estrella (conexión con hoy)

LUMEN puede ser el pre-clasificador barato del JAE: hace el primer pase de defect-signals/etiquetado, y el juez Agent (Claude, caro) solo toca lo ambiguo. Eso abarata el sistema que construimos hoy — exactamente "darle una función a LUMEN en el pipeline".

¿Qué sigue? (elige)

  1. Arreglar lumen_generate (repuntar a HTTP 10.0.0.2:11434 + qwen2.5-coder:14b) → desbloquea uso programático. El unblock real.
  2. POC: LUMEN como pre-clasificador del JAE — medir su accuracy vs gold-set en batch.
  3. Cerrar el drift INFRA_MANIFEST/MEMORY (modelo real).

Mi inclinación: #1 primero (sin la tool arreglada, nada de LUMEN es programable), luego #2. ¿Arranco con el fix de la tool?