ember-memory-test/episodes/TRAZA_enjambre-cerrado-y-refut-trabajo-mo_S20260823.R1_XX.ops.2.hot_inf.in.cc.es.000.MGQ_J.PMCFK_E.SGNFD.md
Ember 754ca75963 feat(episode): TRAZA_enjambre-cerrado-y-refut-trabajo-mo_S20260823.R1_XX.ops.2.hot_inf.in.cc.es.000.MGQ_J.PMCFK_E.SGNFD
Skill: TESSERA | Type: troubleshooting
Summary: EPISODIO 1 — PROBATOR: Enjambre cerrado — y refutó trabajo mío
2026-08-23 18:03:42 +00:00

2.8 KiB

episode_id puente_flat session_code acto_dialogico actor_flujo criticidad_aegis skill_dominante fase_proyecto tipo_semantico summary_one_line source_type trust_boundary created_at relectura_tagged forgejo_commit_sha
f20bf316-abf5-40a1-9f51-60dc0037604b TRAZA_enjambre-cerrado-y-refut-trabajo-mo_S20260823.R1_XX.ops.2.hot_inf.in.cc.es.000.MGQ_J.PMCFK_E.SGNFD S20260823.SID4BCC8DB97BCD informar multi_actor low TESSERA operations troubleshooting EPISODIO 1 — PROBATOR: Enjambre cerrado — y refutó trabajo mío claude_code internal 2026-08-23T18:03:40.530246+00:00 false pending

Enjambre cerrado — y refutó trabajo mío

14 agentes, 0 errores, 2,59M tokens, ~52 min. Fable planificó y auditó; Opus trabajó y verificó con tres lentes. 2 carriles confirmados, 1 descartado por refutación.

Los campos de curación no están mal calibrados: son inalcanzables

Ayer concluí "mal calibrados". La causa real es peor y más simple:

  • has_decision y has_error_resolution: el crisol los lee con meta.get(..., False), pero el diccionario que produce tessera_pipeline no contiene esas claves (grep → 0 líneas). No hay un clasificador roto: no hay clasificador. True es inalcanzable por construcción.
  • importance_score: el crisol descarta el valor y lo recalcula. Con la criticidad fijada en 2 y el segundo argumento literal 0, la fórmula colapsa a "H si y solo si hay ≥5 entidades". No mide importancia: cuenta entidades. Y L es inalcanzable.
  • Contradicción que nadie había visto: el mismo episodio vale H en el payload y M en el PUENTE. Se contradicen en el 90,8% de los episodios.

Y esto es lo que más me importa decirte

El enjambre refutó una premisa mía de ayer. En el PROBATOR de A5 escribí que la prueba de HyDE era barata porque "las poblaciones ya existen y están etiquetadas (facts_origin, 63%)". Falso por tres vías: es la marca de MNEMO-FACTS y no de HyDE · la cobertura real es 8% · y el 63% sale de un log que nace 9 días después del lockbox.

Una instancia futura habría hecho ese cálculo y habría creído los números. Ya está el AVISO puesto en el documento.

El auditor encontró tres errores dentro del enjambre

Un grep que declaraba exhaustividad falsa · un "copiado verbatim" que no lo era · y una cabecera cuyo "2 de 3 lentes" no cuadra con sus propios registros. Por esto existe el auditor final.

Tres propuestas marcadas — reportadas, no ejecutadas

Editar el crisol (bajo FREEZE, tuyo) · un debilitamiento por omisión (el diseño aprovecha que el validador no valide metadata y mete campos por ese hueco sin extenderlo) · y un probe que saca la clave fuera de .env.local y salta LiteLLM.

Cerrado en este turno, sin tocar nada que exija tu firma