Make0 AI: «USB-флешка для мозга» ИИ-агентов — проект с RAG и графовой памятью
Проект Make0 AI предлагает «мозг на флешке» для ИИ-агентов: общую графовую память, подключаемую через MCP, с RAG-выборкой и показателями LoCoMo...
Тема COMRAD404
Проект Make0 AI предлагает «мозг на флешке» для ИИ-агентов: общую графовую память, подключаемую через MCP, с RAG-выборкой и показателями LoCoMo...
Исследователи предлагают проверять действия LLM-агента до их выполнения, чтобы избежать «тихих» ошибок. Метод показал 95,8% точности для shell-команд и снизил...
Исследователи представили RIPPLE — метод, разделяющий локализацию правок промптов и проверку их безопасности после композиции. Алгоритм повышает успешность валидации до...
Исследователи формализовали задачу предварительной подготовки среды без знания целевых заданий. Мета-агент с архивом превзошёл фиксированные методы на пяти из шести...
Исследователи представили MERIT — бенчмарк для измерения предельной полезности долговременной памяти у LLM-агентов, выполняющих инструментальные задачи. Результаты показывают, что память...
Исследователи представили AhaBench — набор тестов для оценки способности языковых моделей учиться на предыдущем опыте в долгосрочных сценариях. Бенчмарк включает...
Стартап Frigade (YC W23) запустил Assist API — инструмент, который позволяет AI-агентам не просто отвечать текстом, а генерировать пошаговые визуальные...
Google Threat Intelligence Group (GTIG) зафиксировала прецедент: злоумышленники использовали мультиагентный фреймворк для полного цикла атаки на облачный ресурс — от...
Open-source утилита Remarc решает проблему «последних 10%» в работе с код-агентами: вместо длинных сообщений в чате — контекстные комментарии к...
Новый бенчмарк HarvestBench проверяет, сколько «топлива» LLM-агенты готовы потратить, чтобы объехать животное на поле, а не переехать его. Результаты показали...