COMRAD404

Лента

Новости, инструменты и практика ИИ

Step 3.5 Flash: обзор модели StepFun по рейтингу COMRAD404

Step 3.5 Flash занимает 58-е место в рейтинге COMRAD404: модель выделяется низкой ценой, сильным пользовательским предпочтением и открытыми весами, но имеет ограниченную уверенность оценки и...

DeepSeek V3.2: обзор модели, рейтинг и практический выбор

DeepSeek V3.2 выгодна там, где важны низкая стоимость токенов, большой контекст и возможность развернуть открытые веса. Но слабый кодовый суббалл и отсутствие независимого Intelligence Index...

Разобраться в теме

За чем вы следите?

Qwen3.5 397B A17B: обзор модели Alibaba

Qwen3.5 397B A17B выделяется высокой пользовательской предпочтительностью, открытыми весами и длинным контекстом, но её средние оценки качества и кода требуют обязательного теста на целевой нагрузке.

Grok 4.20 beta1 — обзор модели, метрик и ограничений

Grok 4.20 beta1 выделяется почти максимальной оценкой человеческих предпочтений, но занимает лишь 54-е место из-за неполного покрытия независимыми тестами, закрытого доступа и отсутствия данных о...

Рейтинг COMRAD404

Какая модель подходит для вашей задачи?

Топ-100 моделей: качество, код, скорость и стоимость. С фильтрами и описанием методологии.

Открыть рейтинг

Solar pro4: обзор, возможности и ограничения

Solar Pro 4 занимает 53-е место в рейтинге COMRAD404: модель сильнее выглядит в пользовательских предпочтениях и доступности, чем в кодинге и эффективности. Разбираем метрики, стоимость...

DeepSeek V3.1 Terminus Thinking: обзор и место в рейтинге

DeepSeek V3.1 Terminus Thinking занимает 52-е место в рейтинге COMRAD404. Модель сильна по пользовательскому предпочтению, доступности и эффективности, но её итоговый профиль ограничивают умеренные оценки...

Muse Glimmer: обзор модели Meta для локальных агентов

Muse Glimmer занимает 51-е место с COMRAD Score 64,2: модель выделяется пользовательским предпочтением и доступностью, но уступает по качеству и коду. Разбираем сценарии, стоимость API...

Grok 4.20 Beta 0309 Reasoning: обзор модели

Grok 4.20 Beta 0309 Reasoning заняла 50-е место в рейтинге COMRAD404. Модель сильна в пользовательских текстовых сценариях и длинном контексте, но заметно слабее выглядит в...

Qwen3 235B A22B Instruct 2507: обзор модели

Qwen3 235B A22B Instruct 2507 занимает 49-е место в рейтинге COMRAD404. Это крупная MoE-модель с сильной пользовательской оценкой и низкой стоимостью API, но без подтверждённых...

MiMo-V2 Pro: обзор модели Xiaomi в рейтинге COMRAD404

MiMo-V2 Pro — закрытая агентная модель Xiaomi с контекстом до 1M токенов и умеренной базовой ценой API. В рейтинге COMRAD404 она занимает 48-е место: сильнее...