MiMo-V2 Omni — модель для задач, где текст нужно связать с изображениями, аудио, видео или действиями через инструменты. В рейтинге COMRAD404 она занимает 65-е место с COMRAD Score 63,0. Это не универсальный лидер: профиль модели заметно сильнее по человеческому предпочтению, чем по редакционной оценке качества и программированию. Поэтому её разумно рассматривать как недорогой мультимодальный API для прототипов, ассистентов и агентских сценариев, но не как очевидный выбор для критичного кода или автономных процессов без собственного контроля.
Важная оговорка относится к дате среза — 31 августа 2026 года. Официальная документация Xiaomi указывает, что модели серии mimo-v2, включая mimo-v2-omni, были выведены из штатного списка и переведены на новые модели с 30 июня 2026 года. Поэтому цена из паспорта отражает зафиксированный редакцией API-показатель, а не обещание, что именно этот идентификатор будет доступен на тех же условиях после даты среза.
Коротко
- Разработчик: Xiaomi.
- Место: 65-е в рейтинге COMRAD404, редакция 2026 H2.
- Итоговая оценка: COMRAD Score 63,0 из 100. Это нормализованная редакционная оценка, а не процент правильных ответов.
- Главная сильная сторона: human preference — 87,5 из 100; в слепых пользовательских сравнениях текстовая версия получила LMArena rating 1430,4 и заняла 97-е место при 19 421 голосе.
- Мультимодальность: официальный релиз заявляет поддержку текста, зрения и речи; документация указывает контекст до 256K токенов.
- Цена в паспорте: 0,4 доллара за миллион входных токенов и 2 доллара за миллион выходных.
- Скорость: в зафиксированном срезе нет данных о tokens/s и time to first token.
- Лицензия: Proprietary; open weights отсутствуют.
- Статус: не preview, но доступность конкретной V2-модели требует отдельной проверки из-за официального объявления о депрекации.
Паспорт модели
| Параметр | Значение | Как читать показатель |
|---|---|---|
| Название | MiMo-V2 Omni | Канонический идентификатор: mimo-v2-omni |
| Организация | Xiaomi | Разработчик и поставщик экосистемы MiMo |
| Ранг COMRAD404 | 65 | Место в редакции 2026 H2 |
| COMRAD Score | 63,0 из 100 | Нормализованная редакционная оценка |
| Контекст | 262 144 токена | Максимум, зафиксированный в паспорте |
| Вход | 0,4 доллара за 1 млн токенов | Цена зависит от API-провайдера и режима |
| Выход | 2 доллара за 1 млн токенов | Отдельная ставка за сгенерированные токены |
| Выходная скорость | Нет данных | В срезе нет независимого значения tokens/s |
| Time to first token | Нет данных | Задержка до первого токена не зафиксирована |
| LMArena text rating | 1430,4 | Статистический рейтинг слепых попарных сравнений |
| Лицензия и веса | Proprietary; open weights: нет | Локальное развёртывание по открытому чекпойнту не подтверждено |
Паспорт не содержит Artificial Analysis Intelligence Index. Это не означает нулевой результат и не позволяет восстановить его по другим метрикам: в данном срезе показатель отсутствует. Аналогично, нет отдельного LMArena code rating и места в кодовой категории.
Место в рейтинге
65-е место показывает, что MiMo-V2 Omni находится в рабочей середине общего рейтинга, а не в его верхнем эшелоне. COMRAD Score 63,0 формируется из пяти нормализованных суббаллов с разными весами: качество — 40%, human preference — 30%, coding — 15%, efficiency — 10%, access — 5%. Такой профиль объясняет, почему сильный пользовательский рейтинг не превращается автоматически в высокий общий результат.
Для читателя это означает следующее. Модель может хорошо восприниматься в диалоге и убедительно вести обычную мультимодальную работу, но итоговая редакционная оценка учитывает не только впечатление от общения. В неё входят также практическая эффективность, доступность и пригодность для кода. При этом human preference остаётся важным преимуществом: суббалл 87,5 — самый высокий в паспорте.
Рейтинг следует воспринимать как инструмент отбора, а не как абсолютную шкалу интеллекта. Место 65 не говорит, что модель в каждом запросе хуже 64 моделей выше неё. Оно указывает на суммарный баланс выбранных редакцией критериев в конкретной версии рейтинга и на конкретную дату.
Полный контекст методики и положение модели можно посмотреть в рейтинге COMRAD404. Ссылка ведёт на общий рейтинг, а не заменяет проверку модели на вашей коллекции задач.
Разбор пяти суббаллов
| Суббалл | Оценка | Вес | Редакционная интерпретация |
|---|---|---|---|
| Quality | 50,0 из 100 | 0,40 | Базовая оценка качества без выраженного преимущества в паспорте |
| Human preference | 87,5 из 100 | 0,30 | Сильное восприятие ответов пользователями в слепых сравнениях |
| Coding | 50,0 из 100 | 0,15 | Нет основания считать модель специализированным инструментом разработки |
| Efficiency | 70,6 из 100 | 0,10 | Хорошее соотношение практической стоимости и заявленного контекстного окна, но скорость не измерена |
| Access | 42,9 из 100 | 0,05 | Доступность ограничивает итоговый профиль, особенно на фоне статуса V2 |
Наибольший вклад в итоговую оценку дают quality и human preference. У MiMo-V2 Omni они расходятся: 50,0 против 87,5. Это типичный сигнал модели, которую пользователи могут предпочитать за стиль, удобство диалога и способность удерживать задачу, но для которой в редакционном срезе нет достаточного основания говорить о высоком качестве по всему спектру задач.
Efficiency 70,6 выглядит полезно для API-проектов с большими входными документами, однако эту цифру нельзя трактовать как измеренную скорость. В паспорте нет ни output tokens per second, ни time to first token. Доступная цена и большой контекст — разные характеристики, и каждая зависит от условий конкретного провайдера.
Что известно о модели
В официальном релизе Xiaomi MiMo-V2 Omni описывается как omni-modal foundation model, объединяющая текст, зрение и речь. Разработчик отдельно выделяет восприятие изображений, видео и аудио, вызов инструментов, выполнение функций и работу с графическим интерфейсом. Документация по обновлениям фиксирует дату релиза 18 марта 2026 года и максимальный контекст 256K.
Это описание относится к заявлениям разработчика, а не к независимому аудиту. Xiaomi также приводит демонстрационные агентские сценарии: управление браузером, подготовку документов, работу с таблицами и выполнение последовательности действий. Такие примеры полезны для понимания замысла модели, но не заменяют воспроизводимое тестирование на ваших интерфейсах, языках, инструментах и правилах безопасности.
В ходе исследования не найден отдельный публичный model card или репозиторий именно для MiMo-V2 Omni, который раскрывал бы архитектуру, число параметров, тренировочные данные или полный набор воспроизводимых тестов. Наличие репозитория MiMo-V2-Flash не является подтверждением характеристик Omni, поэтому сведения о Flash к этой статье не переносятся.
Возможности и сценарии
Мультимодальные ассистенты
Модель подходит для интерфейсов, где пользователь прикладывает скриншот, фотографию, запись разговора или другой медиаматериал и ожидает текстовое действие: объяснение, классификацию, извлечение полей или подготовку следующего шага. Особенно естественны сценарии поддержки, анализа документов, визуального контроля и обработки входящих обращений.
Агентские цепочки
Заявленные tool invocation, function execution и GUI operation позволяют использовать модель как компонент агента. Она может получать описание доступных функций, выбирать инструмент, обрабатывать результат и продолжать диалог. На практике надёжность зависит не только от модели, но и от схемы функций, валидации аргументов, таймаутов, повторных попыток и разрешений.
Документы и офисная автоматизация
Большое контекстное окно удобно для длинных инструкций, нескольких документов и переписки, которую нужно свести в единый результат. Модель можно проверить на создании структуры отчёта, извлечении данных из PDF, подготовке таблицы или формировании презентационного плана. Финальную проверку чисел, ссылок и форматирования всё равно стоит оставлять за человеком или отдельным валидатором.
Голосовые и визуальные интерфейсы
Официальное позиционирование включает речь и зрение, поэтому MiMo-V2 Omni логично тестировать в голосовых помощниках, мультимодальных чатах, навигации по интерфейсу и обработке видеофрагментов. Не следует автоматически считать её заменой специализированной ASR- или TTS-модели: паспорт подтверждает модальности Omni, но не содержит независимых показателей распознавания и синтеза речи.
Кому модель подойдёт
MiMo-V2 Omni рационально рассматривать командам, которым нужна одна точка входа для текста и медиа, а также возможность подключить функции или браузерные действия. Низкая входная цена делает её интересной для массовых запросов с большим объёмом контекста, если фактический провайдер продолжает обслуживать эту модель или предлагает совместимый маршрут.
Для прототипа продукта модель может быть удобной: сначала вы проверяете восприятие изображений и аудио, затем добавляете структурированный вывод и вызов инструментов. Хороший human-preference суббалл указывает на потенциал комфортного диалога, но не отменяет измерения точности, устойчивости к инструкциям и доли ошибочных действий.
Модель менее очевидна для задач, где главным критерием является генерация и исправление кода. Coding суббалл равен 50,0, а отдельные кодовые рейтинги LMArena в паспорте отсутствуют. Это не доказательство слабости в любом программировании, но достаточная причина не выбирать её для инженерного контура без сравнительного пилота.
Цена и скорость
В паспорте зафиксированы 0,4 доллара за миллион входных токенов и 2 доллара за миллион выходных. Если условно обработать 10 миллионов входных и 1 миллион выходных токенов, расчётная стоимость составит 6 долларов по этим ставкам: 4 доллара за вход и 2 доллара за выход. Это только арифметическая иллюстрация без учёта кэширования, минимальных списаний, мультимодальных единиц, лимитов и политики конкретного API.
Скорость генерации и задержка первого токена в срезе не указаны. Нельзя подставлять сюда показатели других моделей MiMo или рекламные значения платформы. На фактический отклик влияют регион, нагрузка, длина контекста, потоковая выдача, провайдер, режим маршрутизации и формат входных данных.
Отдельный риск связан с жизненным циклом. В официальной документации Xiaomi от 15 июля 2026 года указано, что mimo-v2-omni был официально deprecated 30 июня 2026 года с рекомендацией переходить на новую серию. Поэтому перед интеграцией нужно проверить, принимает ли текущий endpoint именно канонический идентификатор, куда он маршрутизируется и сохраняются ли заявленные ставки. Цена из паспорта не является гарантией будущего тарифа.
Ограничения
- Доступность. Депрекация V2 снижает предсказуемость долгосрочной интеграции. Нужен план миграции и тест совместимой замены.
- Закрытая модель. Лицензия указана как Proprietary, open weights отсутствуют. Нельзя рассчитывать на самостоятельное локальное развёртывание по открытому чекпойнту.
- Нет speed-метрик. В паспорте отсутствуют output tokens/s и TTFT, поэтому SLA по задержке нельзя вывести из рейтинга.
- Нет Artificial Analysis Index. Показатель отсутствует; не стоит заменять его LMArena rating или COMRAD Score.
- Нет code-рейтинга LMArena. Coding суббалл есть, но отдельные raw-данные по кодовой категории не зафиксированы.
- Мультимодальность не равна безошибочности. Изображения, речь и видео могут содержать неоднозначности, шум, мелкий текст и чувствительные данные.
- Агентские действия требуют ограничений. Браузер, файловая система, платежи и внешние сервисы должны работать через разрешённые инструменты с журналированием и подтверждением опасных операций.
- Официальные демонстрации не заменяют независимый тест. Заявленные сценарии Xiaomi следует считать описанием возможностей разработчика, а не универсальной гарантией результата.
Как проверить на своей задаче
Начните не с общего впечатления от чата, а с набора из 50–100 реальных примеров. Разделите их на текстовые, визуальные, аудио- и агентские задачи. Для каждого примера заранее определите эталонный ответ, допустимые варианты, критические ошибки и максимальное время выполнения.
- Зафиксируйте вход. Сохраните одинаковые инструкции, изображения, документы, аудиофрагменты и версии инструментов. Для длинного контекста отдельно отметьте размер в токенах.
- Разделите режимы. Сравнивайте обычный ответ, структурированный JSON, вызов функции и последовательность нескольких инструментов как разные тесты.
- Измеряйте качество. Считайте точность извлечения, полноту, ошибки фактов, корректность формата и долю ответов, требующих ручной правки.
- Проверьте устойчивость. Повторите часть запросов с переставленными данными, шумом на изображении, неполной информацией и конфликтующими инструкциями.
- Проверьте агента. Ограничьте доступ, используйте песочницу и заранее подготовленные фиктивные сервисы. Считайте неверные вызовы, пропущенные шаги, повторы и опасные действия.
- Измерьте экономику. Запишите входные и выходные токены, стоимость, долю повторных запросов и среднее время ответа у фактического провайдера. Отсутствующие в паспорте speed-метрики получите самостоятельно.
- Проверьте миграцию. До запуска убедитесь, что API не перенаправляет V2 на другую модель незаметно. Сохраните тесты, чтобы сравнить результат после изменения маршрута.
Минимальный критерий выбора — не максимальный единичный результат, а приемлемая доля успешных ответов при предсказуемой цене и безопасном поведении. Для клиентского продукта полезно отдельно провести слепую оценку: пусть несколько пользователей сравнят ответы MiMo-V2 Omni с текущей моделью без знания названий. Это лучше связывает высокий human-preference суббалл с вашей аудиторией.
Итоговая оценка
MiMo-V2 Omni — интересный, но переходный вариант мультимодального API. Её профиль строится вокруг удобства взаимодействия и поддержки текста, зрения и речи, а не вокруг доказанной специализации в программировании или прозрачной локальной эксплуатации. Сильный human preference 87,5 и умеренная efficiency 70,6 делают модель привлекательной для ассистентов и недорогих прототипов. COMRAD Score 63,0 и 65-е место одновременно напоминают: универсальность заявлена, но общий баланс не относится к верхней части рейтинга.
Главный практический вопрос на 31 августа 2026 года — не только «насколько хорошо отвечает модель», но и «какой именно endpoint вы получите». Из-за официальной депрекации V2 MiMo-V2 Omni стоит внедрять только с проверкой фактической маршрутизации и заранее подготовленным сценарием перехода. Для эксперимента и ограниченного API-проекта это может быть оправданный выбор; для долгого production-контракта решение следует принимать только после проверки доступности, цены, задержки и качества на собственных данных.
FAQ
Что такое MiMo-V2 Omni?
Это мультимодальная модель Xiaomi, официально позиционируемая для работы с текстом, изображениями, видео, речью, инструментами и агентскими действиями. В паспорте указан контекст 262 144 токена.
Какое место MiMo-V2 Omni занимает в рейтинге COMRAD404?
Модель занимает 65-е место в редакции 2026 H2 и получает COMRAD Score 63,0 из 100. Это нормализованная редакционная оценка, а не процент качества.
В чём её главный плюс?
Главное преимущество профиля — высокий human-preference суббалл 87,5 из 100. Текстовая LMArena-оценка составляет 1430,4 при 19 421 голосе; это статистический рейтинг попарных сравнений, а не доля правильных ответов.
Сколько стоит MiMo-V2 Omni?
В паспорте указаны 0,4 доллара за миллион входных токенов и 2 доллара за миллион выходных. Эти ставки зависят от API-провайдера, режима и доступности конкретного идентификатора и не должны восприниматься как неизменные.
Известна ли скорость модели?
Нет. В зафиксированном срезе отсутствуют и output tokens per second, и time to first token. Их нужно измерить самостоятельно на выбранном endpoint.
Можно ли запустить модель локально?
Паспорт указывает Proprietary и отсутствие open weights. Публичного открытого чекпойнта именно MiMo-V2 Omni в исследовании не найдено, поэтому локальное развёртывание по весам не подтверждено.
Стоит ли использовать модель в production?
Только после пилота и проверки жизненного цикла. Официальная документация Xiaomi сообщает о депрекации моделей V2 с 30 июня 2026 года, поэтому для production обязательны проверка маршрутизации, контроль стоимости и план миграции.
Источники
- Официальный релиз Xiaomi MiMo-V2-Omni — заявленные модальности, агентские возможности, инструменты и опубликованные разработчиком сведения о цене.
- Официальная история релизов MiMo — дата релиза 18 марта 2026 года и контекст до 256K токенов.
- Официальная документация по моделям Xiaomi MiMo — текущий каталог, ограничения и уведомление о депрекации V2.
- Официальная документация Xiaomi MiMo — сведения о маршрутизации и переходе с V2 на новые модели.
- LMArena Text Leaderboard — независимый пользовательский рейтинг слепых попарных сравнений; числовые значения для статьи взяты из паспорта.
- Artificial Analysis LLM Leaderboard — источник для проверки Intelligence Index, цены, скорости и контекста; Intelligence Index для этой модели в паспорте отсутствует.
- Рейтинг моделей ИИ COMRAD404 — место MiMo-V2 Omni и редакционные суббаллы в редакции 2026 H2.
