Skill: TESSERA | Type: troubleshooting Summary: EPISODIO 1 — PROBATOR: Enjambre cerrado — y refutó trabajo mío
2.8 KiB
| episode_id | puente_flat | session_code | acto_dialogico | actor_flujo | criticidad_aegis | skill_dominante | fase_proyecto | tipo_semantico | summary_one_line | source_type | trust_boundary | created_at | relectura_tagged | forgejo_commit_sha |
|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|
| f20bf316-abf5-40a1-9f51-60dc0037604b | TRAZA_enjambre-cerrado-y-refut-trabajo-mo_S20260823.R1_XX.ops.2.hot_inf.in.cc.es.000.MGQ_J.PMCFK_E.SGNFD | S20260823.SID4BCC8DB97BCD | informar | multi_actor | low | TESSERA | operations | troubleshooting | EPISODIO 1 — PROBATOR: Enjambre cerrado — y refutó trabajo mío | claude_code | internal | 2026-08-23T18:03:40.530246+00:00 | false | pending |
Enjambre cerrado — y refutó trabajo mío
14 agentes, 0 errores, 2,59M tokens, ~52 min. Fable planificó y auditó; Opus trabajó y verificó con tres lentes. 2 carriles confirmados, 1 descartado por refutación.
Los campos de curación no están mal calibrados: son inalcanzables
Ayer concluí "mal calibrados". La causa real es peor y más simple:
has_decisionyhas_error_resolution: el crisol los lee conmeta.get(..., False), pero el diccionario que producetessera_pipelineno contiene esas claves (grep→ 0 líneas). No hay un clasificador roto: no hay clasificador.Truees inalcanzable por construcción.importance_score: el crisol descarta el valor y lo recalcula. Con la criticidad fijada en 2 y el segundo argumento literal 0, la fórmula colapsa a "H si y solo si hay ≥5 entidades". No mide importancia: cuenta entidades. YLes inalcanzable.- Contradicción que nadie había visto: el mismo episodio vale
Hen el payload yMen el PUENTE. Se contradicen en el 90,8% de los episodios.
Y esto es lo que más me importa decirte
El enjambre refutó una premisa mía de ayer. En el PROBATOR de A5 escribí que la prueba de HyDE era barata porque "las poblaciones ya existen y están etiquetadas (facts_origin, 63%)". Falso por tres vías: es la marca de MNEMO-FACTS y no de HyDE · la cobertura real es 8% · y el 63% sale de un log que nace 9 días después del lockbox.
Una instancia futura habría hecho ese cálculo y habría creído los números. Ya está el AVISO puesto en el documento.
El auditor encontró tres errores dentro del enjambre
Un grep que declaraba exhaustividad falsa · un "copiado verbatim" que no lo era · y una cabecera cuyo "2 de 3 lentes" no cuadra con sus propios registros. Por esto existe el auditor final.
Tres propuestas marcadas — reportadas, no ejecutadas
Editar el crisol (bajo FREEZE, tuyo) · un debilitamiento por omisión (el diseño aprovecha que el validador no valide metadata y mete campos por ese hueco sin extenderlo) · y un probe que saca la clave fuera de .env.local y salta LiteLLM.