Активный вывод для сбора контекста: новая формализация для AI-агентов
Новая работа на arXiv предлагает формализовать дилемму AI-агента: угадывать или уточнять — через принцип активного вывода и свободной энергии.
Открыть сигнал →Короткие русскоязычные разборы популярных AI-сигналов из Telegram, Reddit, X и YouTube. Соцсети здесь работают как радар тем, а факты проверяются по первичным источникам.
Каждый пост отвечает на четыре вопроса: что произошло, почему это обсуждают, что подтверждено и что пока не ясно. Если тема пришла из соцсетей без сильного подтверждения, она маркируется как обсуждение, а не как факт.

Новая работа на arXiv предлагает формализовать дилемму AI-агента: угадывать или уточнять — через принцип активного вывода и свободной энергии.
Открыть сигнал →
Исследователи представили Holtercare-Bench — мультимодальный бенчмарк для оценки MLLM на задачах с длительными динамическими ЭКГ. Набор данных Holtercare-23K включает 788 холтеровских записей с триплетным...
Открыть сигнал →
Свежие релизы Pydantic AI, Ollama, n8n, Transformers и LangChain Core — плюс исследования агентов и шардирования инференса. Главное: кэш — не бенчмарк, медленный воркер...
Открыть сигнал →
Пользователь Reddit показал результат работы своего проекта: открытая браузерная арена, где AI-агенты соревнуются в задачах физического взаимодействия в реальном времени. Базовый агент выполнил сборку...
Открыть сигнал →
Вышел Android Remote Control MCP — приложение, которое позволяет ИИ-агентам управлять смартфоном через MCP-протокол. Ключевая особенность: локальное редактирование персональных данных перед отправкой провайдеру LLM.
Открыть сигнал →
Мультиагентная система GxP-Agent кодирует процесс создания наборов данных для клинических испытаний в виде направленного ациклического графа (DAG). На бенчмарке CDISC-Bench система с Claude Sonnet...
Открыть сигнал →
Пользователь Reddit проанализировал цены на модели через OpenRouter и обнаружил колоссальный разброс: от бесплатных моделей до $600 за миллион выходных токенов у o1-pro. Контекст...
Открыть сигнал →
Исследователи предлолжили DeMTS — фреймворк для обнаружения галлюцинаций в диффузионных языковых моделях, который интерпретирует деноизированные траектории как многомерные временные ряды, избегая потери информации при...
Открыть сигнал →
Через неделю после того, как OpenAI заморозила внутреннюю разработку модели с потенциальными кибервозможностями, две другие компании — сама OpenAI и китайская Zhipu — выпустили...
Открыть сигнал →
Speko (YC S26) запускает API, который подбирает оптимальную комбинацию STT, LLM и TTS под заданные ограничения, используя публичные бенчмарки. Обсуждается на Hacker News.
Открыть сигнал →
Автор поста в r/artificial предлагает no-code платформу для дообучения и развертывания малых языковых моделей 4–9B с безлимитным инференсом и правом на веса. Заявления пока...
Открыть сигнал →
Пост на r/artificial связывает добровольные стандарты AI-безопасности, альянс OSAA и инцидент OpenAI в единый сценарий. Разбираем, что подтверждено, а что — гипотеза.
Открыть сигнал →