feat(episode): TRAZA_el-veredicto-exhaustivo_S20260601.R75_XX.ops.2.hot_inf.in.cc.es.000.MGQ_J.PMCFK_E.SGNFD

Skill: NONE | Type: troubleshooting
Summary: EPISODIO 75 — BLINDADAS: El veredicto exhaustivo
This commit is contained in:
Ember 2026-06-06 07:02:30 +00:00
parent 016a4ebe97
commit a4797cc1f5

View file

@ -0,0 +1,41 @@
---
episode_id: "c37eff68-5bf2-453a-984c-346c0abd4665"
puente_flat: "TRAZA_el-veredicto-exhaustivo_S20260601.R75_XX.ops.2.hot_inf.in.cc.es.000.MGQ_J.PMCFK_E.SGNFD"
session_code: "S20260601.LUMEN_CAPACIDAD_LLM_LIGERO"
acto_dialogico: "informar"
actor_flujo: "multi_actor"
criticidad_aegis: "low"
skill_dominante: "NONE"
fase_proyecto: "operations"
tipo_semantico: "troubleshooting"
summary_one_line: "EPISODIO 75 — BLINDADAS: El veredicto exhaustivo"
source_type: "claude_code"
trust_boundary: "internal"
created_at: "2026-06-06T07:01:33.159152+00:00"
relectura_tagged: false
forgejo_commit_sha: "pending"
---
**Probe exhaustivo cerrado, doc corregido (`PROBE_LUMEN_CAPACIDAD_S20260601.md`).** Aquí está la verdad completa que pediste verificar:
## El veredicto exhaustivo
| Carga | Tiempo total | ¿Sirve? |
|---|---|---|
| Episodio (14b, 1687 tok) | **112s** | 🔴 timeout permanente |
| Episodio (7b) | **30s** | 🟠 timeout borde |
| Tarea corta (~40 tok) | **3s** | 🟢 viable |
**Causa raíz confirmada (tu hipótesis, exacta):** LUMEN es **CPU-only, sin GPU** (`vram=0`). El cuello no es la inteligencia (el JSON sale perfecto) ni la tool — es que **procesar el input largo de un episodio en CPU tarda 89 segundos solo en leerlo**. A esa velocidad, clasificar episodios = timeouts permanentes. Exactamente lo que dijiste.
## La historia de la decisión que esto abre
Veníamos de "¿le damos a LUMEN una función en el pipeline?". El probe exhaustivo reveló que la pregunta real es de **hardware, no de software**: con la máquina actual, LUMEN solo puede tareas de **input corto** (3s). Las tres salidas:
1. **GPU para LUMEN** — una tarjeta en el host convierte 112s→~3-5s y vuelve viable la clasificación de episodios local. *Inversión de hardware; lo barato a largo plazo si el volumen es alto.*
2. **LUMEN solo para tareas cortas** — defect-signals pequeños, etiquetas únicas, mini-HyDE. *Cero inversión, valor limitado.*
3. **Episodios siguen en la nube** (Claude/Gemini) — donde la latencia no es problema. *Lo que ya funciona; LUMEN se queda fuera del trabajo pesado.*
Mi inclinación honesta: para el **JAE**, opción 3 (el juez pesado en la nube) + opción 2 (LUMEN solo para pre-filtros cortos de 3s) — **no** montar clasificación de episodios en LUMEN hasta que haya GPU. Pero esto es tuyo: ¿hay GPU disponible/presupuesto para LUMEN, o lo dejamos para tareas cortas + nube?
**Y reconozco:** mi veredicto "viable batch" de hace dos turnos fue prematuro — tu "verifica esto primero, exhaustivo" lo destapó. Es la misma lección de no declarar "funciona" sin carga real. Quedó corregido en el doc con AVISO DLC-2.