COMRAD404

Лента

Новости, инструменты и практика ИИ

«Мы действительно верим, что ИИ может убить всех людей»: ведущий safety-исследователь Anthropic оценил риск выше 10%

Руководитель отдела alignment science Anthropic Эван Хубингер публично признал, что вероятность гибели человечества от ИИ превышает 10% в ближайшие десять лет. Заявление прозвучало через несколько...

Google GTIG: ИИ-агенты взломали облачную инфраструктуру и собрали учетные данные за шесть часов

Google Threat Intelligence Group (GTIG) зафиксировала прецедент: злоумышленники использовали мультиагентный фреймворк для полного цикла атаки на облачный ресурс — от компрометации до массового сбора учетных...

Meta запустила персонального ИИ-агента Muse: он получит доступ к почте, календарям и платежам пользователей

Meta представила Muse — персонального ИИ-агента, который подключается к электронной почте, календарям, платежным сервисам и приложениям для здоровья. Запуск, анонсированный 8 сентября 2026 года, стал...

Разобраться в теме

За чем вы следите?

Пять AI-моделей сыграли сезон гольфа: почему мы неправильно бенчмаркаем агентов

Разработчик провел необычный эксперимент: пять AI-моделей соревновались в симуляторе гольфа. Результаты ставят под сомнение традиционные методы оценки агентов.

GitHub Enterprise Server 3.22: новые инструменты для администрирования и безопасности

Выпущена версия 3.22 корпоративной платформы GitHub Enterprise Server. В релизе — обновления для управления командами, правила репозиториев с гибкими исключениями и улучшения в работе с...

Рейтинг COMRAD404

Какая модель подходит для вашей задачи?

Топ-100 моделей: качество, код, скорость и стоимость. С фильтрами и описанием методологии.

Открыть рейтинг

Remarc: бесплатный инструмент для структурированной обратной связи ИИ-агентам на macOS

Open-source утилита Remarc решает проблему «последних 10%» в работе с код-агентами: вместо длинных сообщений в чате — контекстные комментарии к тексту, скриншотам и веб-элементам с...

OpenAI поддержала Appia Foundation в разработке общих стандартов для продвинутого ИИ

OpenAI сообщила о работе с Appia Foundation над общими подходами к оценке и безопасности продвинутых ИИ-систем. Пока у инициативы больше заявленных целей, чем опубликованных технических...

Как настроить локальный рендеринг контекста для LLM-агентов через Ollama и MCP: архитектура, память и безопасность

Разбираем, как связать локальные модели через Ollama с протоколом Model Context Protocol (MCP) для безопасного управления контекстом агентов без утечки данных в облачные API.

OpenAI представила модель для решения уравнений Навье — Стокса и вызвала споры об авторстве

Исследователи OpenAI применили неанонсированную передовую модель для решения проблемы существования и гладкости решений уравнений Навье — Стокса из списка задач тысячелетия. Результат вызвал критику математиков...

Инфраструктура кеширования промптов в Anthropic Claude API: как сократить расходы до 75% и ускорить агентов

Разбираем архитектуру кеширования промптов в Claude API от Anthropic: как работает механизм сбережения токенов, почему кеш эффективен для длинных системных инструкций и как снизить задержки...

1Password заявила о росте инженерной продуктивности на 21% с Codex. Главный вопрос — не скорость, а границы доступа

1Password связывает 21-процентный рост инженерной продуктивности с использованием OpenAI Codex, но доступные материалы не раскрывают методику измерения. Одновременно компании представили интеграцию, которая переносит секреты из...