04:00
2026-08-04
arxiv.org
artificial-intelligence
AgentMemBench: A Systematic Benchmark for Evaluating Long-Term Memory Management Strategies in Conversational AI Agents
Researchers introduced AgentMemBench, a benchmark evaluating five long-term memory strategies for conversational AI agents across three datasets and 491 annotated question turns, finding that externalβ¦