feat(episode): TRAZA_ese-dato-lo-cambia-todo-y-para-bien_S20260821.R1_XX.ops.2.hot_inf.in.cc.es.000.MGQ_J.PMCFK_E.SGNFD
Skill: NONE | Type: troubleshooting Summary: EPISODIO 1 — MNEMO: Ese dato lo cambia todo — y para bien
This commit is contained in:
parent
06640f05d7
commit
81a2fa8f44
1 changed files with 45 additions and 0 deletions
|
|
@ -0,0 +1,45 @@
|
||||||
|
---
|
||||||
|
episode_id: "6c82e027-0fe8-4dd2-8627-d94b91d1b21a"
|
||||||
|
puente_flat: "TRAZA_ese-dato-lo-cambia-todo-y-para-bien_S20260821.R1_XX.ops.2.hot_inf.in.cc.es.000.MGQ_J.PMCFK_E.SGNFD"
|
||||||
|
session_code: "S20260821.SHERPA_EXPERTO_PDF_GB10"
|
||||||
|
acto_dialogico: "informar"
|
||||||
|
actor_flujo: "multi_actor"
|
||||||
|
criticidad_aegis: "low"
|
||||||
|
skill_dominante: "NONE"
|
||||||
|
fase_proyecto: "operations"
|
||||||
|
tipo_semantico: "troubleshooting"
|
||||||
|
summary_one_line: "EPISODIO 1 — MNEMO: Ese dato lo cambia todo — y para bien"
|
||||||
|
source_type: "claude_code"
|
||||||
|
trust_boundary: "internal"
|
||||||
|
created_at: "2026-08-22T05:29:06.397090+00:00"
|
||||||
|
relectura_tagged: false
|
||||||
|
forgejo_commit_sha: "pending"
|
||||||
|
---
|
||||||
|
|
||||||
|
# Ese dato lo cambia todo — y para bien
|
||||||
|
|
||||||
|
100 MB por archivo no es "un PDF grande". Es una restricción que **decide sola** la pregunta más difícil del diseño.
|
||||||
|
|
||||||
|
## La aritmética, que conviene que veas
|
||||||
|
|
||||||
|
| Si tus PDF son… | Páginas aprox. | Tokens aprox. |
|
||||||
|
|---|---|---|
|
||||||
|
| Texto digital | 2.000 – 10.000 | 1,2M – 6M |
|
||||||
|
| Escaneos / imágenes | 200 – 800 | (según OCR) |
|
||||||
|
|
||||||
|
La ventana de contexto del modelo titular del GB10 son **65.536 tokens**. Tu documento es, en texto, **entre 18 y 90 veces más grande que todo lo que el modelo puede mirar de una vez**. Ni siquiera forzando su ventana máxima publicada (262K) se acerca: seguiría siendo 5-25 veces más grande.
|
||||||
|
|
||||||
|
`★ Insight ─────────────────────────────────────`
|
||||||
|
**"Meterle el PDF entero" pasó de ser caro a ser imposible.** Eso es buena noticia: elimina una rama entera del diseño y deja la pregunta *correcta* al descubierto. Ya no es *"¿contexto largo o recuperación?"*. Es: **¿cómo se razona sobre algo que nunca cabe entero?**
|
||||||
|
|
||||||
|
Y ahí aparece la trampa real. Recuperar fragmentos responde muy bien *"¿qué dice el artículo 47?"* y muy mal *"¿qué sostiene este documento en conjunto?"* — porque para lo segundo no hay un fragmento que contenga la respuesta. Se necesita algo construido **una sola vez por documento** (un mapa, resúmenes jerárquicos por sección) además de la búsqueda por pregunta.
|
||||||
|
`─────────────────────────────────────────────────`
|
||||||
|
|
||||||
|
## Qué cambié en el paquete
|
||||||
|
|
||||||
|
- **F-23 / F-24** — tu dato, con la aritmética de magnitud hecha y marcada como *estimate* (los rangos dependen de si son texto o escaneos, y eso aún no lo sé).
|
||||||
|
- **DD-1 reenmarcado** — de "elige entre A y B" a "resuelve el problema real": qué se construye una vez por documento vs. qué se busca por pregunta, y **cómo se responde una pregunta de síntesis global**.
|
||||||
|
- **R-11, restricción nueva** — el coste de *admitir* un documento es de primera clase. Fable debe declarar con cifra: cuánto tarda procesar el archivo una sola vez, cuánta RAM pica (compite con el modelo cargado), que el extractor trabaje **página a página sin cargar los 100 MB en memoria**, y cuánto ocupa el índice.
|
||||||
|
- **R-9 con una advertencia honesta** — un PDF de 100 MB *huele* a escaneado (el texto plano rara vez pesa tanto), pero lo marqué como **inferencia, no dato**: rama probable, no hecho.
|
||||||
|
|
||||||
|
**Gate:** PASS · 14.219 tokens · 0 violaciones.
|
||||||
Loading…
Reference in a new issue