EM^2Mem: Event-Centric Multimodal Memory for Large Language Models Paper • 2609.00551 • Published 18 days ago • 13
Learning to Evaluate Before Improving: Automatic Rubric Induction for Automatic Research Agents Paper • 2608.31076 • Published 19 days ago • 22
MemTrapBench: Benchmarking Cognitive Traps in LLM Memory Use Paper • 2608.20202 • Published 30 days ago • 34
MemTrapBench: Benchmarking Cognitive Traps in LLM Memory Use Paper • 2608.20202 • Published 30 days ago • 34
Mechanist: AI as a Scientific Instrument for Discovering the Mechanisms of Intelligence Paper • 2608.12036 • Published Aug 12 • 88
Mechanist: AI as a Scientific Instrument for Discovering the Mechanisms of Intelligence Paper • 2608.12036 • Published Aug 12 • 88
Mechanist: AI as a Scientific Instrument for Discovering the Mechanisms of Intelligence Paper • 2608.12036 • Published Aug 12 • 88
OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents Paper • 2608.05013 • Published Aug 4 • 38
OneDayAgent: Towards a Long-Horizon Harness for Autonomous Agents Paper • 2608.05013 • Published Aug 4 • 38