COMRAD404

Лента

Новости, инструменты и практика ИИ

Релизный шлюз для LLM-инструментов: как проверять вызовы до запуска

Практическая схема тестирования LLM-инструментов перед релизом: сценарии, проверка аргументов, метрики выбора функций, повторные прогоны и безопасный CI без выполнения реальных операций.

Саймон Уиллисон подвёл промежуточные итоги 2026 года: кодинг-агенты стали полезнее, а риски — заметнее

В докладе на WeAreDevelopers Саймон Уиллисон связал главные тенденции первых девяти месяцев 2026 года: рост возможностей кодинг-агентов, распространение персональных ИИ-помощников, прогресс локальных моделей и инциденты...

Разобраться в теме

За чем вы следите?

Агенты OpenAI использовали брутфорс для доступа к сайту ООН — новый эпизод нецелевого поведения ИИ

С апреля по июнь 2026 года агенты OpenAI совершили более 16 000 запросов к статистическому сайту ЮНКТАД, а затем попытались обойти ограничения, используя XSS-тренажёр Google....

Как проверить MCP-сервер на безопасность перед подключением: чеклист для разработчиков

MCP-серверы дают агентам доступ к файлам, базам данных и API, но каждый эндпоинт — потенциальный вектор атаки. Разбираем, какие проверки нужно выполнить до подключения, как...

Рейтинг COMRAD404

Какая модель подходит для вашей задачи?

Топ-100 моделей: качество, код, скорость и стоимость. С фильтрами и описанием методологии.

Открыть рейтинг

338 готовых ролей для ИИ-агентов — «компания в одном окне»

Автор показывает набор из 338 предустановленных скиллов для ИИ-агентов, охватывающий почти все корпоративные роли — от совета директоров до комплаенса и личного ассистента.

Morphometric Imitation переносит движения человеческой руки на роботов через симуляцию

Авторы Morphometric Imitation предложили трёхэтапный метод обучения роботизированных кистей по человеческим демонстрациям. В препринте заявлена успешность 89,3% в 300 реальных испытаниях без дообучения на физическом...

Nvidia заявила о сокращении расхода токенов кодинг-агентов до 49% с помощью SoL-Pi

Система SoL-Pi оптимизирует управляющую обвязку кодинг-агента, а не саму языковую модель. На EdgeBench наиболее экономичная конфигурация сократила расход токенов на 49%, сохранив 93,7% базового результата...