ember-memory-test/episodes/EXPLORA_query-expansion-hyde-de-lectura-alta_S20260719.R2_XX.ops.2.hot_inf.in.cc.es.000.MGQ_J.PMCFK_E.SGNFD.md
Ember 71c55b893c feat(episode): EXPLORA_query-expansion-hyde-de-lectura-alta_S20260719.R2_XX.ops.2.hot_inf.in.cc.es.000.MGQ_J.PMCFK_E.SGNFD
Skill: NONE | Type: chronicle
Summary: EPISODIO 2 — MNEMO_PRE_DIGEST: **Query expansion / HyDE de lectura** (ALTA —...
2026-07-20 04:49:09 +00:00

2.6 KiB
Raw Blame History

episode_id puente_flat session_code acto_dialogico actor_flujo criticidad_aegis skill_dominante fase_proyecto tipo_semantico summary_one_line source_type trust_boundary created_at relectura_tagged forgejo_commit_sha
beb1825c-8430-4fd3-848c-6bfd3338acd8 EXPLORA_query-expansion-hyde-de-lectura-alta_S20260719.R2_XX.ops.2.hot_inf.in.cc.es.000.MGQ_J.PMCFK_E.SGNFD S20260719.ORACULO_RETRIEVAL_X09 informar multi_actor low NONE operations chronicle EPISODIO 2 — MNEMO_PRE_DIGEST: **Query expansion / HyDE de lectura** (ALTA —... claude_code internal 2026-07-20T04:48:54.921356+00:00 false pending

Lo importante: el premio sigue sobre la mesa. El techo quedó re-confirmado (la respuesta correcta está en el top-10 el 88% de las veces). La brecha de orden es real — solo que exige una herramienta más quirúrgica: un cross-encoder dedicado (modelo entrenado específicamente para rankear, viviría local en el servidor MEMORIA), anotado como siguiente candidato con su propia infra. Y la dimensión-pregunta (query-expansion) sigue virgen y barata como candidata #1.

El marcador final del día S20260719

14 hipótesis puestas a prueba con criterio pre-registrado — cada una respondió en minutos y ninguna tocó producción sin gate: 5 del arco oráculo · summary-solo · jerarquía A y B · sessionizer · HyDE-en-texto · near-dup-en-hechos · vara-igualada-a-escala · reranker ×2. Y los 5 ganadores desplegados y verificados: backfill (0.06→0.149→serie v2 en 0.542), writer v1.1, search_facts (+0.259 factuales), bi-temporalidad (0.967/100%), wiring del summary autorado. 22 commits triple-remoto.

  • Hice: el micro-experimento que autorizaste, con su iteración disciplinada (dev-set exclusivo, el examen jamás se quemó) y su FAIL honesto documentado.
  • Falta: solo el reloj — el gate 48h (~S20260721) → tu GO al writer v1.2 (hechos + FACT-PUENTE "capturar sin confiar"). La cola de estudio quedó priorizada en el ARCO: query-expansion barata, cross-encoder con infra, y el arco de capacidad nueva (reflexión-generativa + procedimental).
  • Mi consejo: este SÍ es el punto de cierre natural — no por contexto, sino porque el siguiente dato duro del pipeline necesita 48 horas de mundo real. El día quedó completo: verdad medida, sistema mejorado 2.5×, y un mapa donde hasta los fracasos tienen acta.
  • Para avanzar: 🟢 A — cierre aquí; la próxima ventana lee el gate y sigue el ARCO (recomendado) · 🟡 B — un experimento más de la cola (query-expansion, ~30 min) · C — algo que quieras revisar del día.