feat(episode): TRAZA_4-el-hallazgo-mayor-hay-dos-memorias-y_S20260828.R2_XX.ops.2.hot_inf.in.cc.es.000.MGQ_J.PMCFK_E.SGNFD

Skill: NONE | Type: troubleshooting
Summary: EPISODIO 2 — MEMORIA: 4 · El hallazgo mayor: hay dos memorias, y la otra gana
This commit is contained in:
Ember 2026-09-04 04:11:01 +00:00
parent 13038c2908
commit 86713db654

View file

@ -0,0 +1,54 @@
---
episode_id: "ebc7587c-6d4a-418a-bbdf-2678ea677371"
puente_flat: "TRAZA_4-el-hallazgo-mayor-hay-dos-memorias-y_S20260828.R2_XX.ops.2.hot_inf.in.cc.es.000.MGQ_J.PMCFK_E.SGNFD"
session_code: "S20260828.SID3E411925EAA3"
acto_dialogico: "informar"
actor_flujo: "multi_actor"
criticidad_aegis: "low"
skill_dominante: "NONE"
fase_proyecto: "operations"
tipo_semantico: "troubleshooting"
summary_one_line: "EPISODIO 2 — MEMORIA: 4 · El hallazgo mayor: hay dos memorias, y la otra gana"
source_type: "claude_code"
trust_boundary: "internal"
created_at: "2026-09-04T04:10:52.557557+00:00"
relectura_tagged: false
forgejo_commit_sha: "pending"
---
**Mismo buscador. Mismo archivo. Mismos recuerdos objetivo. Solo cambié de dónde salían las preguntas del examen:**
| Examen usado | Acierto |
|---|---|
| El banco de siempre | **8 de cada 100** |
| Otro banco, igual de sintético | **70 de cada 100** |
**El resultado se mueve 62 puntos según qué examen uses.** El tamaño del archivo explica solo 4-8 puntos. **Manda el examen, no la memoria.**
Y lo más sólido: **otra instancia llegó a la misma conclusión por su cuenta**, con otro método (248 preguntas reescritas por cuatro redactores ciegos). Dos mediciones independientes, misma conclusión.
**Qué significa para ti, en concreto:**
- El **"×2" del reordenador sigue siendo válido** — se midió contra el mismo examen antes y después, y una comparación así sobrevive al sesgo.
- Pero **"Ember recuerda al 14 %" es una frase falsa.** La cifra real está entre 8 y 70, y ningún examen actual la localiza.
- **Solo lo resuelven tus preguntas.** Por eso te pedí 15 escritas de memoria: es la única fuente que no deriva del texto que el sistema ya indexó.
—
## 4 · El hallazgo mayor: hay dos memorias, y la otra gana
Todo el trabajo anterior medía **una** de las dos formas de recordar. Ember tiene dos:
- **Ruta narrativa** — busca *conversaciones enteras*. La que llevábamos semanas puliendo.
- **Ruta factual** — busca *datos sueltos* (`"el servidor MEMORIA tiene 32 GB"`). Desplegada el 19 de julio y **sin medir durante 45 días**, mientras publicaba una ventaja que nadie había vuelto a comprobar.
Le hice **la misma pregunta a las dos** y las puse a competir:
| | Acierto a la primera | Entre las cinco primeras |
|---|---|---|
| **Ruta factual** | **45 de 100** | **70 de 100** |
| **Ruta narrativa** | 20 de 100 | 27 de 100 |
Con significancia estadística seria (p = 0,0015; gana 18 veces contra 3). Y **replicó lo medido en julio casi exactamente**: julio dio +0,259, septiembre +0,250, con otro generador de preguntas y otra configuración.
**Lo que más importa:** la ruta narrativa tiene poco margen (el recuerdo correcto ni entra en el top-10 seis de cada diez veces). La ruta factual llega a **70 de 100** en el mismo examen. **Llevábamos semanas arreglando la carretera lenta sin notar que al lado había una autopista.**