COMRAD404

Лента

Новости, инструменты и практика ИИ

Google нанимает нобелевских экономистов, чтобы доказать пользу ИИ: что не так с этой картиной?

Google расширяет программу AI & Economy, привлекая нобелевского лауреата Филиппа Агийона и других звёзд экономики. Но на фоне ухода собственных топ-исследователей, скандалов с безопасностью ИИ...

Нужно ли читать код, умер ли RAG и убили ли Skills MCP?

Главные споры вокруг AI-разработки сводятся не к выбору победившей технологии, а к распределению контекста, риска и ответственности. Разбираем, где заканчиваются громкие формулировки GitHub и начинаются...

Разобраться в теме

За чем вы следите?

Salesforce делает ставку на управляемых ИИ-агентов: что известно об Agentforce и кейсе Southwest

Salesforce развивает Agentforce как платформу для тестирования, интеграции и контроля корпоративных ИИ-агентов. MarkTechPost сообщает о семикратной отдаче от внедрения в Southwest Airlines, однако методика расчёта...

Рейтинг COMRAD404

Какая модель подходит для вашей задачи?

Топ-100 моделей: качество, код, скорость и стоимость. С фильтрами и описанием методологии.

Открыть рейтинг

Исследование поискового поведения LLM-агентов: кто, как и зачем ищет в интернете

Учёные впервые проанализировали полный цикл веб-поиска четырёх популярных LLM-платформ: ChatGPT, Claude, Grok и DeepSeek. Выяснилось, что частота обращений к поиску не гарантирует качество ответов, а...

ООН запускает Data Commons для прямого доступа ИИ-агентов к статистике

ООН переносит статистику своих агентств на платформу с поддержкой MCP. Проект должен дать ИИ-агентам доступ к первичным данным и их происхождению, однако результаты моделей по-прежнему...

Reflective Recovery: как научить LLM исправлять собственные ошибки без внешних оценщиков

Исследователи представили Reflective Recovery — метод самообучения LLM на собственных неудачных попытках решения задач. Подход ломает «коллапс масштабирования» и позволяет моделям развивать саморефлексию без внешних...

GitHub добавил в Copilot Impact Dashboard метрику вовлечённости по функциям

GitHub обновил Copilot Impact Dashboard для корпоративных клиентов: теперь администраторы видят, сколько активных пользователей регулярно применяют ключевые функции Copilot за скользящий 28-дневный период. Те же...

Anthropic раскрыла, какую долю работы над новыми ИИ-моделями уже выполняет Claude

Компания Anthropic опубликовала внутренние метрики, согласно которым Claude участвует более чем в 90% исследовательских процессов и «ведёт» 26% работы по созданию следующих поколений ИИ. Доля...

AI-компании обсуждают замедление гонки моделей, но общих правил пока нет

Anthropic, OpenAI и Microsoft представили новые подходы к контролю передовых моделей и AI-агентов. Публичные заявления пока не складываются в общий мораторий, а сообщения об инцидентах...