feat(episode): EXPLORA_el-humo-corre-en-segundo-plano-el-corpus_S20260831.R1_XX.ops.2.hot_inf.in.cc.es.000.MGQ_J.PMCFK_E.SGNFD
Skill: TESSERA | Type: troubleshooting Summary: EPISODIO 1 — Ember: El humo corre en segundo plano (el corpus...
This commit is contained in:
parent
dfd10b5735
commit
ad04d6140a
1 changed files with 24 additions and 0 deletions
|
|
@ -0,0 +1,24 @@
|
||||||
|
---
|
||||||
|
episode_id: "16687311-7ae2-4c01-b6c5-c48154de69e4"
|
||||||
|
puente_flat: "EXPLORA_el-humo-corre-en-segundo-plano-el-corpus_S20260831.R1_XX.ops.2.hot_inf.in.cc.es.000.MGQ_J.PMCFK_E.SGNFD"
|
||||||
|
session_code: "S20260831.SID4EC5B030F7F0"
|
||||||
|
acto_dialogico: "informar"
|
||||||
|
actor_flujo: "multi_actor"
|
||||||
|
criticidad_aegis: "low"
|
||||||
|
skill_dominante: "TESSERA"
|
||||||
|
fase_proyecto: "operations"
|
||||||
|
tipo_semantico: "troubleshooting"
|
||||||
|
summary_one_line: "EPISODIO 1 — Ember: El humo corre en segundo plano (el corpus..."
|
||||||
|
source_type: "claude_code"
|
||||||
|
trust_boundary: "internal"
|
||||||
|
created_at: "2026-09-05T00:19:17.011047+00:00"
|
||||||
|
relectura_tagged: false
|
||||||
|
forgejo_commit_sha: "pending"
|
||||||
|
---
|
||||||
|
|
||||||
|
El humo corre en segundo plano (el corpus de 120 episodios ya exige cientos de embeddings). Mientras aterriza, te dejo el cuadro de lo que se está midiendo y por qué importa. ## Qué prueba este experimento
|
||||||
|
|
||||||
|
Hoy EMBER guarda **un vector por episodio**: cada recuerdo entero — de unos 2.000 caracteres — se comprime en un solo punto del espacio semántico. Es como resumir un capítulo completo en una sola frase y luego intentar encontrar el capítulo buscando por cualquier detalle que contenga. El detalle se diluye. El experimento parte cada episodio en trozos, indexa cada trozo por separado, y al buscar se queda con el **mejor trozo** como puntuación del episodio padre. La pregunta: ¿encuentra más así? `★ Insight ─────────────────────────────────────`
|
||||||
|
**El diseño evita la trampa que ya me mordió dos veces esta sesión.** El banco V2 escribió sus preguntas leyendo *el cuerpo* de los episodios — así que las preguntas comparten mucho vocabulario con ese cuerpo (solape 0,48 medido, frente a 0,05 con el título). Si comparara "trozos del cuerpo" contra "producción" estaría inflando el resultado. Por eso el control **no** es producción: es *el mismo cuerpo sin trocear*. Ambos brazos comen del mismo texto, así que el sesgo se cancela y lo único que queda medido es la **granularidad**. `─────────────────────────────────────────────────`
|
||||||
|
|
||||||
|
Y el instrumento trae la salvaguarda que lo hace creíble: **trocear en un solo trozo debe reproducir exactamente el control**.
|
||||||
Loading…
Reference in a new issue