DeepSeek V3.1 Terminus Thinking: обзор и место в рейтинге
DeepSeek V3.1 Terminus Thinking занимает 52-е место в рейтинге COMRAD404. Модель сильна по пользовательскому предпочтению, доступности и эффективности, но её...
Редактор направления «Агенты и инфраструктура»
Павел Миронов отвечает в COMRAD404 за агентные системы и инфраструктуру вокруг моделей. Его материалы посвящены тому, как устроены цепочки инструментов, память, поиск, маршрутизация и контроль выполнения задач.
В разборах делает акцент на архитектуре, отказоустойчивости, наблюдаемости и цене эксплуатации — на всём, что отличает эффектную демонстрацию от работающего процесса.
DeepSeek V3.1 Terminus Thinking занимает 52-е место в рейтинге COMRAD404. Модель сильна по пользовательскому предпочтению, доступности и эффективности, но её...
Kimi K2.5 Thinking занимает 42-е место с COMRAD Score 65,5. Модель выделяется высокой оценкой пользовательских предпочтений и доступными весами, но...
GLM-5.1 занимает 32-е место в срезе COMRAD404 2026 H2. Модель особенно сильна в пользовательских сравнениях и коде, предлагает открытые веса...
Gemini 3.1 Pro Preview выделяется максимальным суббаллом человеческих предпочтений и контекстом на миллион токенов, но теряет позиции из-за задержки первого...
DeepSeek V4 Pro High 20260813 заняла 12-е место в рейтинге COMRAD404 благодаря сильным оценкам качества, предпочтения пользователей и кода. Главный...
GLM-5.3 Flash занимает второе место в срезе COMRAD404 2026 H2. Разбираем, почему модель получила высокий итоговый балл, где сильны её...
Meta выпустила Llama 4 с акцентом на мультимодальность и длинный контекст, DeepSeek V3 остаётся стандартом для рассуждений и кода. Разбираем,...
Разбор актуальных подходов к проектированию автономных ИИ-агентов в инженерной инфраструктуре, ключевые фреймворки, ограничения изоляции и практические проверки кода.
Облачный инфраструктурный провайдер Lambda привлек $1 миллиард в рамках нового раунда частного долга. Средства пойдут на закупку чипов Nvidia, которые...
GitHub обновил инструмент Copilot Code Review. Теперь сервис умеет проверять Pull Request'и от ботов и облачных агентов Copilot без лицензии,...
Предварительный сигнал Critical по Astra заставил OpenAI ограничить темп масштабирования. Разбираем логику release gate, мониторинга, внешней проверки и доверенного доступа.
Lovable, известный платформой для создания веб-приложений с помощью ИИ, объявил о переходе к концепции «capabilities» — функций приложений, доступных напрямую...