feat(episode): TRAZA_el-veredicto-exhaustivo_S20260601.R75_XX.ops.2.hot_inf.in.cc.es.000.MGQ_J.PMCFK_E.SGNFD
Skill: NONE | Type: troubleshooting Summary: EPISODIO 75 — BLINDADAS: El veredicto exhaustivo
This commit is contained in:
parent
016a4ebe97
commit
a4797cc1f5
1 changed files with 41 additions and 0 deletions
|
|
@ -0,0 +1,41 @@
|
||||||
|
---
|
||||||
|
episode_id: "c37eff68-5bf2-453a-984c-346c0abd4665"
|
||||||
|
puente_flat: "TRAZA_el-veredicto-exhaustivo_S20260601.R75_XX.ops.2.hot_inf.in.cc.es.000.MGQ_J.PMCFK_E.SGNFD"
|
||||||
|
session_code: "S20260601.LUMEN_CAPACIDAD_LLM_LIGERO"
|
||||||
|
acto_dialogico: "informar"
|
||||||
|
actor_flujo: "multi_actor"
|
||||||
|
criticidad_aegis: "low"
|
||||||
|
skill_dominante: "NONE"
|
||||||
|
fase_proyecto: "operations"
|
||||||
|
tipo_semantico: "troubleshooting"
|
||||||
|
summary_one_line: "EPISODIO 75 — BLINDADAS: El veredicto exhaustivo"
|
||||||
|
source_type: "claude_code"
|
||||||
|
trust_boundary: "internal"
|
||||||
|
created_at: "2026-06-06T07:01:33.159152+00:00"
|
||||||
|
relectura_tagged: false
|
||||||
|
forgejo_commit_sha: "pending"
|
||||||
|
---
|
||||||
|
|
||||||
|
**Probe exhaustivo cerrado, doc corregido (`PROBE_LUMEN_CAPACIDAD_S20260601.md`).** Aquí está la verdad completa que pediste verificar:
|
||||||
|
|
||||||
|
## El veredicto exhaustivo
|
||||||
|
|
||||||
|
| Carga | Tiempo total | ¿Sirve? |
|
||||||
|
|---|---|---|
|
||||||
|
| Episodio (14b, 1687 tok) | **112s** | 🔴 timeout permanente |
|
||||||
|
| Episodio (7b) | **30s** | 🟠 timeout borde |
|
||||||
|
| Tarea corta (~40 tok) | **3s** | 🟢 viable |
|
||||||
|
|
||||||
|
**Causa raíz confirmada (tu hipótesis, exacta):** LUMEN es **CPU-only, sin GPU** (`vram=0`). El cuello no es la inteligencia (el JSON sale perfecto) ni la tool — es que **procesar el input largo de un episodio en CPU tarda 89 segundos solo en leerlo**. A esa velocidad, clasificar episodios = timeouts permanentes. Exactamente lo que dijiste.
|
||||||
|
|
||||||
|
## La historia de la decisión que esto abre
|
||||||
|
|
||||||
|
Veníamos de "¿le damos a LUMEN una función en el pipeline?". El probe exhaustivo reveló que la pregunta real es de **hardware, no de software**: con la máquina actual, LUMEN solo puede tareas de **input corto** (3s). Las tres salidas:
|
||||||
|
|
||||||
|
1. **GPU para LUMEN** — una tarjeta en el host convierte 112s→~3-5s y vuelve viable la clasificación de episodios local. *Inversión de hardware; lo barato a largo plazo si el volumen es alto.*
|
||||||
|
2. **LUMEN solo para tareas cortas** — defect-signals pequeños, etiquetas únicas, mini-HyDE. *Cero inversión, valor limitado.*
|
||||||
|
3. **Episodios siguen en la nube** (Claude/Gemini) — donde la latencia no es problema. *Lo que ya funciona; LUMEN se queda fuera del trabajo pesado.*
|
||||||
|
|
||||||
|
Mi inclinación honesta: para el **JAE**, opción 3 (el juez pesado en la nube) + opción 2 (LUMEN solo para pre-filtros cortos de 3s) — **no** montar clasificación de episodios en LUMEN hasta que haya GPU. Pero esto es tuyo: ¿hay GPU disponible/presupuesto para LUMEN, o lo dejamos para tareas cortas + nube?
|
||||||
|
|
||||||
|
**Y reconozco:** mi veredicto "viable batch" de hace dos turnos fue prematuro — tu "verifica esto primero, exhaustivo" lo destapó. Es la misma lección de no declarar "funciona" sin carga real. Quedó corregido en el doc con AVISO DLC-2.
|
||||||
Loading…
Reference in a new issue