Память LLM-агентам нужна, но не любая: MERIT оценивает цену и пользу
Исследователи представили MERIT — бенчмарк для измерения предельной полезности долговременной памяти у LLM-агентов, выполняющих инструментальные задачи. Результаты показывают, что память...






