Запись архива

MiMo-V2 Pro: обзор модели Xiaomi в рейтинге COMRAD404

MiMo-V2 Pro — закрытая агентная модель Xiaomi с контекстом до 1M токенов и умеренной базовой ценой API. В рейтинге COMRAD404 она занимает 48-е место: сильнее всего выглядит в пользовательских предпочтениях, но не лидирует по качеству и коду.

MiMo-V2 Pro от Xiaomi — профиль модели, метрики COMRAD404 и параметры API

MiMo-V2 Pro стоит рассматривать как специализированную API-модель для агентных сценариев, а не как универсального победителя рейтинга. Её главное практическое преимущество — сочетание контекста до 1 048 576 токенов, цены $1 за миллион входных и $3 за миллион выходных токенов в базовом тарифном режиме, а также сильного результата в слепых пользовательских сравнениях. При этом профиль неоднороден: редакционная оценка качества составляет 50,0 из 100, кодовая — 54,7, а официальная открытость ограничена закрытым доступом к модели через API.

По паспорту COMRAD404, MiMo-V2 Pro разработана Xiaomi, не относится к preview, не поддерживает отдельный reasoning-режим в зафиксированном профиле и распространяется по проприетарной лицензии. Поэтому модель особенно интересна командам, которым важны длинные контексты, автоматизация действий и стоимость API, но которым не нужны открытые веса или локальное развёртывание.

Коротко

  • Позиция: 48-е место в выпуске COMRAD404 2026 H2.
  • COMRAD Score: 64,5 из 100. Это нормализованная редакционная оценка, а не процент правильных ответов.
  • Сильнейший суббалл: human preference — 92,5 из 100.
  • Слабее всего в профиле: quality и access — по 50,0 из 100.
  • Слепое текстовое сравнение: LMArena rating 1448,5, 69-е место в текстовой арене, 24 399 голосов.
  • Кодовое сравнение: LMArena rating 1433,4 и 60-е место в Code Arena.
  • Контекст: 1 048 576 токенов.
  • Цена из паспорта: $1 за 1M входных токенов и $3 за 1M выходных токенов.
  • Скорость: в срезе нет данных о time to first token и output tokens per second.

Итог простой: MiMo-V2 Pro может быть рациональным выбором для длинных рабочих процессов и API-прототипов, но её нельзя оценивать только по одному высокому суббаллу пользовательских предпочтений.

Паспорт модели

Параметр Значение в срезе
Модель MiMo-V2 Pro
Разработчик Xiaomi
Лицензия Proprietary
Открытые веса Нет
Reasoning Нет
Preview Нет
Уверенность паспорта Средняя
Контекст 1 048 576 токенов
COMRAD Score 64,5 из 100
LMArena Text 1448,5; место 69; 24 399 голосов
LMArena Code 1433,4; место 60
Artificial Analysis Intelligence Index Данных в срезе нет
Выходная скорость Данных в срезе нет
Time to first token Данных в срезе нет

Паспорт фиксирует модель в конкретном редакционном срезе на 31 августа 2026 года. Это важно для цены, доступности и рейтингов: API-провайдер может менять тарифы, лимиты, маршрутизацию и технические характеристики.

Место в рейтинге

MiMo-V2 Pro занимает 48-е место в рейтинге COMRAD404 2026 H2 с COMRAD Score 64,5 из 100. Позиция означает не «64,5 процента качества», а итог нормализации пяти редакционных измерений с весами: quality — 40%, human preference — 30%, coding — 15%, efficiency — 10%, access — 5%. Подробнее о месте модели можно свериться с рейтингом COMRAD404.

Главная особенность позиции — разрыв между компонентами оценки. Модель получила 92,5 из 100 за human preference, но только 50,0 за quality и access. Это говорит о том, что в пользовательских попарных сравнениях она воспринимается заметно лучше, чем выглядит в более широком редакционном профиле доступности и качества. Такой результат полезен для чатовых и интерактивных задач, где важны ясность, уместность ответа и общее впечатление от диалога.

LMArena rating нельзя трактовать как процент успешных ответов. Это статистический рейтинг по слепым попарным сравнениям. Значение 1448,5 отражает положение модели в текстовой арене на основании 24 399 голосов, а не долю решённых задач. Кодовый рейтинг 1433,4 и 60-е место указывают на конкурентоспособность в программных запросах, но не доказывают, что модель надёжно закрывает любой инженерный тикет.

Что означает профиль суббаллов

Суббалл Оценка Редакционная интерпретация
Quality 50,0 из 100 Средняя позиция в общей оценке качества; не основание считать модель универсальным лидером.
Human preference 92,5 из 100 Самая сильная сторона: модель хорошо воспринимается пользователями в слепых сравнениях.
Coding 54,7 из 100 Рабочий, но не исключительный профиль для программирования и инженерных запросов.
Efficiency 60,5 из 100 Умеренно сильное сочетание стоимости и доступных характеристик; измеренная скорость отсутствует.
Access 50,0 из 100 Закрытая лицензия и отсутствие открытых весов ограничивают автономность и варианты развёртывания.

Суббаллы нужно читать вместе. Высокий human preference не отменяет средних quality и coding, а efficiency нельзя считать полной оценкой быстродействия: в исходном паспорте нет чисел для output tokens per second и time to first token. Следовательно, редакционная интерпретация эффективности опирается на цену и доступный контекст, но не на прямое измерение задержки.

Возможности и сценарии

Официальная страница Xiaomi описывает MiMo-V2 Pro как фундаментальную модель для агентных рабочих процессов: планирования цепочек действий, вызова инструментов, программной разработки и автоматизации задач. Там же заявлены гибридное внимание, Multi-Token Prediction и контекст до 1M токенов. Это официальные заявления разработчика, а не независимое подтверждение всех характеристик. ([mimo.xiaomi.com](https://mimo.xiaomi.com/mimo-v2-pro))

Длинные документы и рабочие базы

Контекст в 1 048 576 токенов позволяет проектировать процессы с большими наборами документов: анализом репозитория, сводкой длинной переписки, сопоставлением нескольких спецификаций или последовательной обработкой журналов. На практике максимальное окно не гарантирует одинаковую точность на любой позиции контекста. Перед внедрением стоит проверять поиск фактов в начале, середине и конце длинного ввода.

Агентные цепочки

Модель подходит для сценариев, где ответ является не финальным текстом, а шагом процесса: вызвать функцию, прочитать результат, выбрать следующий инструмент, изменить файл или составить план. Высокий human preference поддерживает гипотезу о хорошей интерактивности, но стабильность многошагового агента нужно измерять отдельно: одна удачная демонстрация не равна надёжности на сотнях запусков.

Разработка программного обеспечения

Кодовый суббалл 54,7 из 100 и 60-е место в LMArena Code делают модель кандидатом для генерации шаблонного кода, ревью, написания тестов, объяснения ошибок и работы с небольшими изменениями в репозитории. Для автономного исправления сложных багов нужна защитная обвязка: песочница, тесты, ограничение прав и обязательная проверка diff. Рейтинг Code Arena — статистический ориентир, а не гарантия прохождения конкретного набора тестов.

Чат и прикладной текст

Именно здесь сильный human preference выглядит наиболее релевантно. MiMo-V2 Pro разумно тестировать в поддержке, подготовке черновиков, классификации обращений, редактуре и интерактивном поиске по внутренним материалам. Для юридических, медицинских и финансовых текстов модель не следует использовать без профильной проверки, независимо от её места в рейтинге.

Цена и скорость

В паспорте указана цена $1 за миллион входных токенов и $3 за миллион выходных токенов. Это единицы тарификации, а не стоимость готового запроса и не показатель качества. Итоговый счёт зависит от длины контекста, объёма ответа, повторного использования кэша, тарифного плана и конкретного API-провайдера.

Официальная страница Xiaomi указывает, что для контекста до 256K действуют одни тарифные условия, а для диапазона 256K–1M — повышенные. Поэтому базовые значения из паспорта нельзя механически переносить на любой запрос с миллионным окном. Перед расчётом бюджета проверьте действующую таблицу тарификации у выбранного провайдера; официальные условия могут обновляться. ([mimo.xiaomi.com](https://mimo.xiaomi.com/mimo-v2-pro))

Данные о скорости в срезе отсутствуют: нет ни output tokens per second, ни time to first token. Нельзя честно назвать MiMo-V2 Pro быстрой или медленной на основании одной архитектурной заявки. Для пользовательского интерфейса измеряйте задержку первого токена, для пакетной обработки — полное время ответа, а для агента — время завершения всей цепочки, включая вызовы инструментов.

Доступ, лицензия и эксплуатационная модель

Лицензия в паспорте обозначена как Proprietary, а открытые веса отсутствуют. Это означает, что MiMo-V2 Pro следует воспринимать как сервисную модель с доступом через API, а не как чекпойнт для свободного локального запуска. Закрытый статус не делает модель хуже автоматически, но повышает зависимость от условий провайдера, его региональной доступности, политики хранения данных и изменений API.

Перед передачей чувствительных данных проверьте договорные условия, журналы запросов, срок хранения, возможность отключения обучения на пользовательских данных и процедуры удаления. В корпоративной эксплуатации также важны резервный маршрут, лимиты запросов и совместимость SDK с форматом вызова инструментов. Эти параметры не зафиксированы в паспорте, поэтому их нельзя считать гарантированными.

Ограничения

  • Нет Artificial Analysis Intelligence Index. В редакционном срезе показатель отсутствует, поэтому его нельзя восстанавливать по месту в другом рейтинге или по заявлениям Xiaomi.
  • Нет данных о скорости. Не опубликованы значения output tokens per second и time to first token в паспорте.
  • Нет открытых весов. Локальное развёртывание, самостоятельное дообучение и аудит параметров не входят в доступный профиль.
  • Средние quality и coding. Высокое пользовательское впечатление не превращается автоматически в одинаково сильное решение сложных задач.
  • Неоднозначная экономика длинного контекста. Тариф для больших окон может отличаться от базовых $1/$3 за миллион токенов.
  • Средняя уверенность паспорта. Это редакционный сигнал проверять критичные выводы собственными тестами, а не считать оценку окончательной.
  • Рейтинги зависят от выборки. LMArena отражает слепые попарные сравнения и число голосов, но не заменяет тестирование на вашем наборе данных.

Отдельно важно не путать официальное описание агентных и многошаговых возможностей с наличием отдельного reasoning-режима: в паспорте MiMo-V2 Pro отмечена как модель без reasoning. Для интеграции нужно проверять фактические параметры API, а не выводить их из маркетингового описания.

Как проверить на своей задаче

  1. Соберите репрезентативную выборку. Возьмите 50–200 реальных запросов, включая типичные, пограничные и заведомо сложные случаи. Удалите персональные и коммерчески чувствительные данные.
  2. Разделите задачи по классам. Отдельно оцените чат, извлечение фактов, длинный контекст, код, вызов инструментов и форматирование структурированного ответа.
  3. Зафиксируйте протокол. Одинаковые системные инструкции, температура, лимит вывода, схема инструментов и критерии остановки должны применяться ко всем прогонам.
  4. Проверьте длинный контекст. Разложите контрольные факты на разных участках документа и попросите модель найти их с указанием источника. Измеряйте пропуски и ложные ссылки.
  5. Проверьте код в песочнице. Запускайте сгенерированные тесты автоматически, запрещайте сетевой доступ без необходимости и оценивайте не только прохождение тестов, но и качество diff.
  6. Измерьте экономику. Считайте входные и выходные токены, долю повторных запросов, стоимость неудачных агентных шагов и расходы на длинные контексты.
  7. Измерьте задержку. Запишите p50 и p95 для time to first token, скорости генерации и полной цепочки действий. В паспорте этих данных нет, поэтому их должен получить пользователь.
  8. Сравните с текущим baseline. Используйте уже принятую в компании модель и одинаковые критерии: точность, редактирование человеком, время до результата, стоимость и доля аварийных завершений.

Минимальный практический пилот — двухнедельный shadow-тест без автоматического исполнения опасных действий. Модель сначала предлагает решение, а оператор подтверждает вызовы инструментов. После накопления статистики можно постепенно расширять автономность для низкорисковых операций.

Кому подойдёт MiMo-V2 Pro

Модель имеет смысл выбирать, если вам нужен большой контекст, API-доступ, агентная логика и умеренная базовая цена. Хорошие кандидаты — внутренний помощник по документации, анализ репозиториев, генерация черновиков, маршрутизация обращений, подготовка структурированных данных и прототипы инструментальных агентов.

Выбор менее очевиден, если приоритетом являются открытые веса, локальный запуск, предсказуемая задержка, строгая независимость от одного поставщика или доказанная надёжность на узком профессиональном датасете. В таких случаях сначала нужно проверить юридические и инфраструктурные требования, а уже затем смотреть на место в рейтинге.

FAQ

Какое место занимает MiMo-V2 Pro?

В выпуске COMRAD404 2026 H2 модель занимает 48-е место и получает COMRAD Score 64,5 из 100. Это нормализованная редакционная оценка, не процент качества и не вероятность правильного ответа.

Какой у MiMo-V2 Pro контекст?

В паспорте указан контекст 1 048 576 токенов, то есть до 1M токенов. Фактическая доступность такого окна может зависеть от тарифа и API-провайдера.

Сколько стоит MiMo-V2 Pro?

В зафиксированном паспорте указаны $1 за 1M входных токенов и $3 за 1M выходных токенов. Для больших контекстов провайдер может применять отдельный тариф, поэтому перед запуском нужно проверить актуальные условия.

Есть ли у модели открытые веса?

Нет. В паспорте указаны проприетарная лицензия и отсутствие open weights. Модель следует рассматривать как закрытый API-сервис.

Подходит ли MiMo-V2 Pro для программирования?

Подходит для пилотов и прикладных инженерных задач: кодовый суббалл составляет 54,7 из 100, а в LMArena Code модель занимает 60-е место с рейтингом 1433,4. Для автономных изменений в production обязательны тесты, песочница и ручное подтверждение.

Можно ли назвать её быстрой?

Нет достаточных данных для такого вывода. В паспорте отсутствуют output tokens per second и time to first token. Скорость следует измерить самостоятельно у конкретного провайдера и в конкретном режиме.

Есть ли у MiMo-V2 Pro reasoning-режим?

В редакционном паспорте reasoning отмечен как отсутствующий. Официальное описание Xiaomi говорит об агентных, инструментальных и многошаговых сценариях, но это не является подтверждением отдельного пользовательского reasoning-переключателя.

Источники

Рейтинг COMRAD404 использован как внутренняя редакционная ссылка для позиции и методики среза. Остальные материалы — первичные или benchmark-источники, применённые для проверки названия, официального описания и данных LMArena.

  • COMRAD404 AI Ranking — место MiMo-V2 Pro и редакционный контекст рейтинга.
  • Страница MiMo-V2 Pro на сайте Xiaomi — официальное описание назначения модели, заявленные архитектурные особенности, контекст и тарифные уровни.
  • LMArena Text Leaderboard — текстовый рейтинг, место, rating и число голосов в зафиксированном представлении арены.
  • LMArena Leaderboard — источник для кодового направления, использованного в паспорте.
  • Artificial Analysis: LLM Leaderboard — проверяемый источник для Intelligence Index, цен, скорости, контекста и функций API; Intelligence Index для этой модели в паспорте отсутствует.

Дата среза: 31 августа 2026 года. Значения цены, доступности, рейтингов и API-характеристик могут изменяться после этой даты.