feat(episode): TRAZA_ese-dato-lo-cambia-todo-y-para-bien_S20260821.R1_XX.ops.2.hot_inf.in.cc.es.000.MGQ_J.PMCFK_E.SGNFD

Skill: NONE | Type: troubleshooting
Summary: EPISODIO 1 — MNEMO: Ese dato lo cambia todo — y para bien
This commit is contained in:
Ember 2026-08-22 05:29:14 +00:00
parent 06640f05d7
commit 81a2fa8f44

View file

@ -0,0 +1,45 @@
---
episode_id: "6c82e027-0fe8-4dd2-8627-d94b91d1b21a"
puente_flat: "TRAZA_ese-dato-lo-cambia-todo-y-para-bien_S20260821.R1_XX.ops.2.hot_inf.in.cc.es.000.MGQ_J.PMCFK_E.SGNFD"
session_code: "S20260821.SHERPA_EXPERTO_PDF_GB10"
acto_dialogico: "informar"
actor_flujo: "multi_actor"
criticidad_aegis: "low"
skill_dominante: "NONE"
fase_proyecto: "operations"
tipo_semantico: "troubleshooting"
summary_one_line: "EPISODIO 1 — MNEMO: Ese dato lo cambia todo — y para bien"
source_type: "claude_code"
trust_boundary: "internal"
created_at: "2026-08-22T05:29:06.397090+00:00"
relectura_tagged: false
forgejo_commit_sha: "pending"
---
# Ese dato lo cambia todo — y para bien
100 MB por archivo no es "un PDF grande". Es una restricción que **decide sola** la pregunta más difícil del diseño.
## La aritmética, que conviene que veas
| Si tus PDF son… | Páginas aprox. | Tokens aprox. |
|---|---|---|
| Texto digital | 2.000 10.000 | 1,2M 6M |
| Escaneos / imágenes | 200 800 | (según OCR) |
La ventana de contexto del modelo titular del GB10 son **65.536 tokens**. Tu documento es, en texto, **entre 18 y 90 veces más grande que todo lo que el modelo puede mirar de una vez**. Ni siquiera forzando su ventana máxima publicada (262K) se acerca: seguiría siendo 5-25 veces más grande.
`★ Insight ─────────────────────────────────────`
**"Meterle el PDF entero" pasó de ser caro a ser imposible.** Eso es buena noticia: elimina una rama entera del diseño y deja la pregunta *correcta* al descubierto. Ya no es *"¿contexto largo o recuperación?"*. Es: **¿cómo se razona sobre algo que nunca cabe entero?**
Y ahí aparece la trampa real. Recuperar fragmentos responde muy bien *"¿qué dice el artículo 47?"* y muy mal *"¿qué sostiene este documento en conjunto?"* — porque para lo segundo no hay un fragmento que contenga la respuesta. Se necesita algo construido **una sola vez por documento** (un mapa, resúmenes jerárquicos por sección) además de la búsqueda por pregunta.
`─────────────────────────────────────────────────`
## Qué cambié en el paquete
- **F-23 / F-24** — tu dato, con la aritmética de magnitud hecha y marcada como *estimate* (los rangos dependen de si son texto o escaneos, y eso aún no lo sé).
- **DD-1 reenmarcado** — de "elige entre A y B" a "resuelve el problema real": qué se construye una vez por documento vs. qué se busca por pregunta, y **cómo se responde una pregunta de síntesis global**.
- **R-11, restricción nueva** — el coste de *admitir* un documento es de primera clase. Fable debe declarar con cifra: cuánto tarda procesar el archivo una sola vez, cuánta RAM pica (compite con el modelo cargado), que el extractor trabaje **página a página sin cargar los 100 MB en memoria**, y cuánto ocupa el índice.
- **R-9 con una advertencia honesta** — un PDF de 100 MB *huele* a escaneado (el texto plano rara vez pesa tanto), pero lo marqué como **inferencia, no dato**: rama probable, no hecho.
**Gate:** PASS · 14.219 tokens · 0 violaciones.