feat(episode): EXPLORA_lo-primero-no-son-decenas-de-terabytes-s_S20260829.R1_XX.ops.2.hot_inf.in.cc.es.000.MGQ_J.PMCFK_E.SGNFD
Skill: NONE | Type: troubleshooting Summary: EPISODIO 1 — MNEMO_PRE_DIGEST: Lo primero: no son decenas de terabytes. Son 14
This commit is contained in:
parent
b339d83e9c
commit
ad792232e7
1 changed files with 49 additions and 0 deletions
|
|
@ -0,0 +1,49 @@
|
||||||
|
---
|
||||||
|
episode_id: "cb790124-9034-4750-9ece-dee8b04ace28"
|
||||||
|
puente_flat: "EXPLORA_lo-primero-no-son-decenas-de-terabytes-s_S20260829.R1_XX.ops.2.hot_inf.in.cc.es.000.MGQ_J.PMCFK_E.SGNFD"
|
||||||
|
session_code: "S20260829.PIPELINE_FIXES"
|
||||||
|
acto_dialogico: "informar"
|
||||||
|
actor_flujo: "multi_actor"
|
||||||
|
criticidad_aegis: "low"
|
||||||
|
skill_dominante: "NONE"
|
||||||
|
fase_proyecto: "operations"
|
||||||
|
tipo_semantico: "troubleshooting"
|
||||||
|
summary_one_line: "EPISODIO 1 — MNEMO_PRE_DIGEST: Lo primero: no son decenas de terabytes. Son 14"
|
||||||
|
source_type: "claude_code"
|
||||||
|
trust_boundary: "internal"
|
||||||
|
created_at: "2026-08-30T17:48:36.664001+00:00"
|
||||||
|
relectura_tagged: false
|
||||||
|
forgejo_commit_sha: "pending"
|
||||||
|
---
|
||||||
|
|
||||||
|
Volvió la investigación del arca, y **el número que traías en la cabeza estaba equivocado por un factor de tres a siete**. Para bien.
|
||||||
|
|
||||||
|
## Lo primero: no son decenas de terabytes. Son 14
|
||||||
|
|
||||||
|
Cuatro lentes midieron los pesos **de verdad** —leyendo las cabeceras de los ficheros en Hugging Face y contrastándolas con la descarga real, no estimando:
|
||||||
|
|
||||||
|
| Qué | Cuánto pesa |
|
||||||
|
|---|---|
|
||||||
|
| Los 10 mejores modelos que **el GB10 sí ejecuta** | **1,51 TB** — cabe en un solo disco |
|
||||||
|
| Los 10 mejores modelos abiertos **absolutos** | 12,56 TB |
|
||||||
|
| Las dos colecciones juntas | **14,07 TB** |
|
||||||
|
|
||||||
|
Tus tres modelos ya elegidos suman **474,8 GB**. Todos Apache-2.0, terreno legal limpio.
|
||||||
|
|
||||||
|
Y hay una regla que sirve para siempre: **el peso original ocupa 2 bytes por parámetro**. Un modelo de 120 mil millones de parámetros pesa 240 GB. Ya no necesitas preguntármelo.
|
||||||
|
|
||||||
|
## Pero el presupuesto no lo decide el tamaño — lo decide el ritmo
|
||||||
|
|
||||||
|
Guardar **todas** las generaciones recientes de solo cuatro familias son **19,63 TB**: más que las dos arcas juntas. GLM publicó **cuatro modelos insignia en cinco meses**, a 1,5 TB cada uno.
|
||||||
|
|
||||||
|
> Aquí es donde 14 TB se vuelven 30 o 100. **El arca no es una foto.** Sin una regla explícita de qué se **borra**, el presupuesto es infinito.
|
||||||
|
|
||||||
|
Y hay un modelo, `Qwen3.8-2.4T`, que **él solo pesa 4,89 TB** — el 39% del arca frontera. No corre en el GB10 ni de lejos. Excluirlo baja la colección de 12,56 a **7,67 TB**.
|
||||||
|
|
||||||
|
## Dónde alojarla
|
||||||
|
|
||||||
|
Descarté el archivo frío de Amazon, Azure y Google, y no por el precio de guardar sino por el de **sacar**: en los tres, el tráfico de salida es **entre el 48% y el 66% de la factura**. Recuperar el arca cuesta 2,4 veces más de lo que costó guardarla tres años.
|
||||||
|
|
||||||
|
Azure además tiene un tope que lo descalifica: **10 GiB por hora**. Recuperar 50 TB tardaría **213 días**. Barato en la hoja de cálculo, inservible en la realidad.
|
||||||
|
|
||||||
|
Quedan dos finalistas, y no compiten en lo mismo:
|
||||||
Loading…
Reference in a new issue