Dario Amodei предложил план «умеренного форсирования» frontier AI. Дженсен Хуанг против
CEO Anthropic выступил с инициативой независимых оценок безопасности и скоординированного развития передовых моделей. Nvidia назвала подход угрозой инновациям.
COMRAD404
Новости, инструменты и практика ИИ
CEO Anthropic выступил с инициативой независимых оценок безопасности и скоординированного развития передовых моделей. Nvidia назвала подход угрозой инновациям.
Google расширяет программу AI & Economy, привлекая нобелевского лауреата Филиппа Агийона и других звёзд экономики. Но на фоне ухода собственных топ-исследователей, скандалов с безопасностью ИИ...
Главные споры вокруг AI-разработки сводятся не к выбору победившей технологии, а к распределению контекста, риска и ответственности. Разбираем, где заканчиваются громкие формулировки GitHub и начинаются...
Разобраться в теме
Anthropic открывает бета-доступ к Life Sciences Verification Program (LSVP) — программе, которая даёт профессионалам в науках о жизнь доступ к Claude Mythos, Opus и Sonnet...
Учёные изучили почти 15 тысяч бенчмарков для LLM, опубликованных на arXiv с 2022 по 2026 год. Главный вывод: растёт запрос на действия, взаимодействие и профессиональные...
Salesforce развивает Agentforce как платформу для тестирования, интеграции и контроля корпоративных ИИ-агентов. MarkTechPost сообщает о семикратной отдаче от внедрения в Southwest Airlines, однако методика расчёта...
Рейтинг COMRAD404
Топ-100 моделей: качество, код, скорость и стоимость. С фильтрами и описанием методологии.
Открыть рейтингУчёные впервые проанализировали полный цикл веб-поиска четырёх популярных LLM-платформ: ChatGPT, Claude, Grok и DeepSeek. Выяснилось, что частота обращений к поиску не гарантирует качество ответов, а...
ООН переносит статистику своих агентств на платформу с поддержкой MCP. Проект должен дать ИИ-агентам доступ к первичным данным и их происхождению, однако результаты моделей по-прежнему...
Исследователи представили Reflective Recovery — метод самообучения LLM на собственных неудачных попытках решения задач. Подход ломает «коллапс масштабирования» и позволяет моделям развивать саморефлексию без внешних...
GitHub обновил Copilot Impact Dashboard для корпоративных клиентов: теперь администраторы видят, сколько активных пользователей регулярно применяют ключевые функции Copilot за скользящий 28-дневный период. Те же...
Компания Anthropic опубликовала внутренние метрики, согласно которым Claude участвует более чем в 90% исследовательских процессов и «ведёт» 26% работы по созданию следующих поколений ИИ. Доля...
Anthropic, OpenAI и Microsoft представили новые подходы к контролю передовых моделей и AI-агентов. Публичные заявления пока не складываются в общий мораторий, а сообщения об инцидентах...