Preprint
Jul 2026
RECON: Benchmarking Agent Memory for Compositional Reasoning over Long Contexts
This work introduces RECON (Reasoning over Extended Contexts with Obfuscated Narratives), a benchmark for evaluating compositional reasoning over long contexts and reveals substantial limitations across current architectures.
M. S. Arya
· 0 citations