GPT-6 Astra: что показали тесты OpenAI и первые пользователи
Разбираем GPT-6 Astra без пересказа пресс-релиза: официальные результаты, цену и первые hands-on тесты в коде, браузере, CRM, hardware и 3D.
COMRAD404
Новости, инструменты и практика ИИ
Разбираем GPT-6 Astra без пересказа пресс-релиза: официальные результаты, цену и первые hands-on тесты в коде, браузере, CRM, hardware и 3D.
Ugreen показала HomeAgent — систему, объединяющую NAS, NVR, Matter-контроллер и локального ИИ-ассистента Uliya. Цены стартуют от $899, но удалённый доступ требует интернета, а совместимость с...
Исследователи разложили обвязку LLM-агента на четыре слота и обнаружили, что почти вся польза от оптимизации сосредоточена в слоте рефлексии, а равномерное распределение вычислительного бюджета между...
Разобраться в теме
Исследователи представили DuplexSpeechBench-IFEval — набор из 1038 тестов для оценки того, как full-duplex голосовые агенты следуют инструкциям, заданным через роль или персону, а не явно....
На arXiv появилась статья, в которой описывается R²Adapter — легковесный адаптер, динамически распределяющий запросы между vanilla RAG и graph-based RAG. Результат: до 59% меньше обращений...
Исследователи представили фреймворк на основе промпт-инжиниринга для персонализации ответов ИИ-ассистента преподавателя. Система учитывает шесть параметров обучаемого, формируя 96 профилей, и анализирует когнитивную сложность запроса по...
Рейтинг COMRAD404
Топ-100 моделей: качество, код, скорость и стоимость. С фильтрами и описанием методологии.
Открыть рейтингРазбираем архитектуру современных ИИ-агентов для разработки, способы изоляции окружения, ограничения моделей при работе с большими кодовыми базами и практические шаги для безопасного внедрения автоматизации.
Практическое руководство по настройке Cursor и Claude 3.5 Sonnet: конфигурация .cursorrules, работа с Composer, Chat, ограничения модели и проверка результатов для автономной разработки кода.
Сравниваем работу Claude Code и GPT-4o в задачах редактирования существующего кода. Тесты на реальных сценариях: рефакторинг, исправление багов, добавление фич. Где каждый сильнее и какие...
Depth Pro от Apple создаёт карты глубины с высоким разрешением за доли секунды без данных о камере. Разбираем, как это работает, сравниваем с аналогами и...
Разработчики жалуются, что для нагрузочного тестирования чат-ботов приходится тратить реальные токены или писать собственные моки. На Hacker News предлагают взять пример со Stripe и внедрить...
В начале сентября GitHub Actions получил три обновления: REST API для отслеживания устаревания версий раннеров, разрешение vulnerability-alerts для GITHUB_TOKEN и новые свойства job context для...