COMRAD404

Лента

Новости, инструменты и практика ИИ

Anthropic заявила об открытии Claude новой системы с CRISPR-подобными повторами

Агенты Claude проанализировали более 200 тысяч обратных транскриптаз и выделили систему ART в геномах бактериофагов. Ее функция пока неизвестна, а результаты представлены в препринте и...

Ежедневное использование ИИ не снижает тревогу американцев — опрос Gallup

Около 68% американцев, использующих ИИ каждый день, обеспокоены последствиями технологии. Опрос Gallup по заказу Microsoft показывает: частое использование не гарантирует доверия к результатам моделей и...

Разобраться в теме

За чем вы следите?

IFEval: как объективно проверить, что AI-агент выполняет ваши инструкции

Разбираемся, как работает бенчмарк IFEval от Google Research, и показываем, как с его помощью протестировать, насколько точно AI-агент следует заданным инструкциям — от форматирования до...

OpenAI представила MentalHealthBench для проверки ответов ИИ о психическом здоровье

OpenAI сообщила о MentalHealthBench — бенчмарке с участием экспертов, который предназначен для оценки полезности и безопасности ответов ИИ в реалистичных разговорах о психическом здоровье.

Рейтинг COMRAD404

Какая модель подходит для вашей задачи?

Топ-100 моделей: качество, код, скорость и стоимость. С фильтрами и описанием методологии.

Открыть рейтинг

Сэм Альтман выступил в Совбезе ООН о безопасности ИИ и человеческом контроле

OpenAI сообщила о выступлении Сэма Альтмана в Совете Безопасности ООН. Главными темами стали безопасность ИИ, сохранение контроля человека и международное сотрудничество.

GitHub Copilot App получил локальную песочницу с изоляцией файловой системы и сети

GitHub запустил публичный превью локальной песочницы для десктопного приложения Copilot. Теперь агентный код выполняется в изолированном окружении с ограничением доступа к файлам, сети и учетным...

Как настроить MCP-сервер для доступа к базе данных: разбор на примере PostgreSQL

Пошаговое руководство по настройке MCP-сервера для работы с PostgreSQL: от установки до тестирования tool calling. Разбор конфигурации, ограничений безопасности и практических кейсов для ИИ-агентов.