Skill: NONE | Type: chronicle Summary: EPISODIO 2 — MNEMO_PRE_DIGEST: **Query expansion / HyDE de lectura** (ALTA —...
2.6 KiB
| episode_id | puente_flat | session_code | acto_dialogico | actor_flujo | criticidad_aegis | skill_dominante | fase_proyecto | tipo_semantico | summary_one_line | source_type | trust_boundary | created_at | relectura_tagged | forgejo_commit_sha |
|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|
| beb1825c-8430-4fd3-848c-6bfd3338acd8 | EXPLORA_query-expansion-hyde-de-lectura-alta_S20260719.R2_XX.ops.2.hot_inf.in.cc.es.000.MGQ_J.PMCFK_E.SGNFD | S20260719.ORACULO_RETRIEVAL_X09 | informar | multi_actor | low | NONE | operations | chronicle | EPISODIO 2 — MNEMO_PRE_DIGEST: **Query expansion / HyDE de lectura** (ALTA —... | claude_code | internal | 2026-07-20T04:48:54.921356+00:00 | false | pending |
Lo importante: el premio sigue sobre la mesa. El techo quedó re-confirmado (la respuesta correcta está en el top-10 el 88% de las veces). La brecha de orden es real — solo que exige una herramienta más quirúrgica: un cross-encoder dedicado (modelo entrenado específicamente para rankear, viviría local en el servidor MEMORIA), anotado como siguiente candidato con su propia infra. Y la dimensión-pregunta (query-expansion) sigue virgen y barata como candidata #1.
El marcador final del día S20260719
14 hipótesis puestas a prueba con criterio pre-registrado — cada una respondió en minutos y ninguna tocó producción sin gate: 5 del arco oráculo · summary-solo · jerarquía A y B · sessionizer · HyDE-en-texto · near-dup-en-hechos · vara-igualada-a-escala · reranker ×2. Y los 5 ganadores desplegados y verificados: backfill (0.06→0.149→serie v2 en 0.542), writer v1.1, search_facts (+0.259 factuales), bi-temporalidad (0.967/100%), wiring del summary autorado. 22 commits triple-remoto.
- Hice: el micro-experimento que autorizaste, con su iteración disciplinada (dev-set exclusivo, el examen jamás se quemó) y su FAIL honesto documentado.
- Falta: solo el reloj — el gate 48h (~S20260721) → tu ⛔GO al writer v1.2 (hechos + FACT-PUENTE "capturar sin confiar"). La cola de estudio quedó priorizada en el ARCO: query-expansion barata, cross-encoder con infra, y el arco de capacidad nueva (reflexión-generativa + procedimental).
- Mi consejo: este SÍ es el punto de cierre natural — no por contexto, sino porque el siguiente dato duro del pipeline necesita 48 horas de mundo real. El día quedó completo: verdad medida, sistema mejorado 2.5×, y un mapa donde hasta los fracasos tienen acta.
- Para avanzar: 🟢 A — cierre aquí; la próxima ventana lee el gate y sigue el ARCO (recomendado) · 🟡 B — un experimento más de la cola (query-expansion, ~30 min) · ⚪ C — algo que quieras revisar del día.