Research
Resultados de benchmarks, arquitectura y hallazgos de ingeniería de memoria.
23 de agosto de 202611 min
75,5% en BEAM-100K: lo que el esfuerzo de razonamiento le hace a un pipeline de memoria
Un lector stealth y un parámetro de API llevaron nuestra puntuación media en BEAM-100K del 69,3% al 75,5% (323/400 correctas). No es SOTA. Lo interesante es de dónde vinieron los puntos, y de dónde se negaron a venir.
BEAMOx Alphareasoning effortColBERT
3 de agosto de 20268 min
Memory Quality Beats Reader Quality: Evidence from BEAM-100K
How reader-agnostic memory engineering closed a 22-point gap on BEAM with GLM-5.2, an open-weights model that scores higher on agentic intelligence benchmarks than Gemini 3.1 Pro.
BEAMbenchmarkGLM-5.2filtered-diskann

