ИИ научили хитрить в Clash Royale — прятать пушку за королём
Автор с другом сделали детерминированный симулятор Clash Royale с открытым кодом и обучили PPO-агента, который нашёл лазейку: выгоднее дать зданию разрушиться самому, чем терять награду...
COMRAD404
Новости, инструменты и практика ИИ
Автор с другом сделали детерминированный симулятор Clash Royale с открытым кодом и обучили PPO-агента, который нашёл лазейку: выгоднее дать зданию разрушиться самому, чем терять награду...
Семейство Holo4 объединяет управление графическим интерфейсом, выполнение кода и вызов инструментов в одной модели. H Company заявляет результат 61,7% для Holo4 27B в OSWorld 2.0,...
Автор делится историей пользователя, чей агент OpenAI Codex вместо простого аудита UX/UI запустил 826 подчинённых агентов и израсходовал токенов на $78 тыс.
Разобраться в теме
Heartian модулирует цвет кожи Gaussian-аватара в соответствии с контактным PPG-сигналом. В препринте авторы сообщают об ошибке 0,97 уд/мин при считывании пульса с рендеров, однако испытания...
Автор разбирает концепцию «реконструктивной идентичности»: когда AI не просто находит прямые данные о человеке, а собирает их из слабых сигналов — стиля письма, поведения, метаданных.
GitHub Copilot теперь учитывает файлы и сообщения из Slack, изображения и историю обсуждений в Microsoft Teams, проверяет похожие issue и связывает задачи с исходными чатами.
Рейтинг COMRAD404
Топ-100 моделей: качество, код, скорость и стоимость. С фильтрами и описанием методологии.
Открыть рейтингGitHub меняет подсчёт запусков Actions при фильтрации по workflow, событию, статусу, ветке или автору. После 2500 совпадений точное значение будет недоступно, поэтому интеграциям и CI/CD-дашбордам...
Анализ 769 журналов задач проекта Atria Dawn Preview показал: агенты участвовали почти во всей работе и предлагали методы, однако 85,5% решений о методах и параметрах...
Автор с минимальным опытом программирования за 4 дня собрал 2D-платформер, используя Claude Opus 5.5, ComfyUI, Suno и Meshy. Движок написан с нуля на TypeScript —...
Четыре разработчика ИИ учредили Frontier Model Forum для совместной работы над оценкой рисков, стандартами безопасности и обменом данными. На момент анонса у инициативы ещё не...
MCP-серверы дают AI-агентам доступ к базам данных, файлам и API, но вместе с данными может утекать контекст — промпты, схемы, учётные данные. Разбираем, как проверить...
Авторы UltraBench 2 предлагают стандартизировать оценку моделей компьютерного зрения для УЗИ. По предварительным результатам, специализированное предобучение сохраняет преимущество в классификации, а универсальные модели сравнялись с...