feat(episode): TRAZA_lo-que-el-probe-encontr-todo-con-evidenc_S20260601.R61_XX.ops.2.hot_inf.in.cc.es.000.MGQ_J.PMCFK_E.SGNFD

Skill: NONE | Type: troubleshooting
Summary: EPISODIO 61 — BLINDADAS: Lo que el probe encontró (todo con evidencia empírica e
This commit is contained in:
Ember 2026-06-02 21:45:59 +00:00
parent 7fe22c8a11
commit 2a67fd8fd7

View file

@ -0,0 +1,42 @@
---
episode_id: "25e5b221-e193-4be7-bb57-2903e5a3282e"
puente_flat: "TRAZA_lo-que-el-probe-encontr-todo-con-evidenc_S20260601.R61_XX.ops.2.hot_inf.in.cc.es.000.MGQ_J.PMCFK_E.SGNFD"
session_code: "S20260601.LUMEN_CAPACIDAD_LLM_LIGERO"
acto_dialogico: "informar"
actor_flujo: "multi_actor"
criticidad_aegis: "low"
skill_dominante: "NONE"
fase_proyecto: "operations"
tipo_semantico: "troubleshooting"
summary_one_line: "EPISODIO 61 — BLINDADAS: Lo que el probe encontró (todo con evidencia empírica este t"
source_type: "claude_code"
trust_boundary: "internal"
created_at: "2026-06-02T21:45:58.799069+00:00"
relectura_tagged: false
forgejo_commit_sha: "pending"
---
**Probe completo — veredicto entregado:** `docs/PROBE_LUMEN_CAPACIDAD_S20260601.md`. Tu razonamiento era correcto y la verificación pagó: descubrimos que **el pipeline no era el problema — la herramienta sí.**
## Lo que el probe encontró (todo con evidencia empírica este turno)
| Pregunta | Respuesta |
|---|---|
| ¿LUMEN soporta una función en el pipeline? | **SÍ** — Qwen2.5-Coder-14B vivo, JSON perfecto, clasificó **FP correctamente** (= gold-set JAE) |
| ¿Qué función? | **Batch/async de clasificación-extracción** (defect-signals JAE, HyDE, pre-digest). NO online (7.8 tok/s) |
| ¿Por qué fallaba `lumen_generate`? | **Tool rota**: usa SSH:22 (caído) + pide `lumen-v4`/QwQ-32B **que no está cargado** (lo real es qwen2.5-coder) |
## La inversión clave que validaste
Si hubiéramos "arreglado el pipeline" primero, habríamos construido sobre una tool rota y un modelo equivocado. Verificar capacidad **primero** reveló que LUMEN está sano — lo roto es el conector MCP + un drift de modelo (boot dice QwQ-32B, realidad qwen2.5-coder). **Tu orden de pensar evitó horas de FORENSE mal dirigido.**
## Función candidata estrella (conexión con hoy)
LUMEN puede ser el **pre-clasificador barato del JAE**: hace el primer pase de defect-signals/etiquetado, y el juez Agent (Claude, caro) solo toca lo ambiguo. Eso abarata el sistema que construimos hoy — exactamente "darle una función a LUMEN en el pipeline".
## ¿Qué sigue? (elige)
1. **Arreglar `lumen_generate`** (repuntar a HTTP `10.0.0.2:11434` + `qwen2.5-coder:14b`) → desbloquea uso programático. *El unblock real.*
2. **POC: LUMEN como pre-clasificador del JAE** — medir su accuracy vs gold-set en batch.
3. **Cerrar el drift** INFRA_MANIFEST/MEMORY (modelo real).
Mi inclinación: **#1 primero** (sin la tool arreglada, nada de LUMEN es programable), luego #2. ¿Arranco con el fix de la tool?