Запись архива

MiMo-V2 Omni: обзор мультимодальной модели Xiaomi

MiMo-V2 Omni — мультимодальная модель Xiaomi с сильным пользовательским предпочтением, контекстом 256K и низкой ценой API. Разбираем рейтинг, сценарии, ограничения и риски доступности.

MiMo-V2 Omni от Xiaomi — профиль мультимодальной модели в рейтинге COMRAD404

MiMo-V2 Omni — модель для задач, где текст нужно связать с изображениями, аудио, видео или действиями через инструменты. В рейтинге COMRAD404 она занимает 65-е место с COMRAD Score 63,0. Это не универсальный лидер: профиль модели заметно сильнее по человеческому предпочтению, чем по редакционной оценке качества и программированию. Поэтому её разумно рассматривать как недорогой мультимодальный API для прототипов, ассистентов и агентских сценариев, но не как очевидный выбор для критичного кода или автономных процессов без собственного контроля.

Важная оговорка относится к дате среза — 31 августа 2026 года. Официальная документация Xiaomi указывает, что модели серии mimo-v2, включая mimo-v2-omni, были выведены из штатного списка и переведены на новые модели с 30 июня 2026 года. Поэтому цена из паспорта отражает зафиксированный редакцией API-показатель, а не обещание, что именно этот идентификатор будет доступен на тех же условиях после даты среза.

Коротко

  • Разработчик: Xiaomi.
  • Место: 65-е в рейтинге COMRAD404, редакция 2026 H2.
  • Итоговая оценка: COMRAD Score 63,0 из 100. Это нормализованная редакционная оценка, а не процент правильных ответов.
  • Главная сильная сторона: human preference — 87,5 из 100; в слепых пользовательских сравнениях текстовая версия получила LMArena rating 1430,4 и заняла 97-е место при 19 421 голосе.
  • Мультимодальность: официальный релиз заявляет поддержку текста, зрения и речи; документация указывает контекст до 256K токенов.
  • Цена в паспорте: 0,4 доллара за миллион входных токенов и 2 доллара за миллион выходных.
  • Скорость: в зафиксированном срезе нет данных о tokens/s и time to first token.
  • Лицензия: Proprietary; open weights отсутствуют.
  • Статус: не preview, но доступность конкретной V2-модели требует отдельной проверки из-за официального объявления о депрекации.

Паспорт модели

Параметр Значение Как читать показатель
Название MiMo-V2 Omni Канонический идентификатор: mimo-v2-omni
Организация Xiaomi Разработчик и поставщик экосистемы MiMo
Ранг COMRAD404 65 Место в редакции 2026 H2
COMRAD Score 63,0 из 100 Нормализованная редакционная оценка
Контекст 262 144 токена Максимум, зафиксированный в паспорте
Вход 0,4 доллара за 1 млн токенов Цена зависит от API-провайдера и режима
Выход 2 доллара за 1 млн токенов Отдельная ставка за сгенерированные токены
Выходная скорость Нет данных В срезе нет независимого значения tokens/s
Time to first token Нет данных Задержка до первого токена не зафиксирована
LMArena text rating 1430,4 Статистический рейтинг слепых попарных сравнений
Лицензия и веса Proprietary; open weights: нет Локальное развёртывание по открытому чекпойнту не подтверждено

Паспорт не содержит Artificial Analysis Intelligence Index. Это не означает нулевой результат и не позволяет восстановить его по другим метрикам: в данном срезе показатель отсутствует. Аналогично, нет отдельного LMArena code rating и места в кодовой категории.

Место в рейтинге

65-е место показывает, что MiMo-V2 Omni находится в рабочей середине общего рейтинга, а не в его верхнем эшелоне. COMRAD Score 63,0 формируется из пяти нормализованных суббаллов с разными весами: качество — 40%, human preference — 30%, coding — 15%, efficiency — 10%, access — 5%. Такой профиль объясняет, почему сильный пользовательский рейтинг не превращается автоматически в высокий общий результат.

Для читателя это означает следующее. Модель может хорошо восприниматься в диалоге и убедительно вести обычную мультимодальную работу, но итоговая редакционная оценка учитывает не только впечатление от общения. В неё входят также практическая эффективность, доступность и пригодность для кода. При этом human preference остаётся важным преимуществом: суббалл 87,5 — самый высокий в паспорте.

Рейтинг следует воспринимать как инструмент отбора, а не как абсолютную шкалу интеллекта. Место 65 не говорит, что модель в каждом запросе хуже 64 моделей выше неё. Оно указывает на суммарный баланс выбранных редакцией критериев в конкретной версии рейтинга и на конкретную дату.

Полный контекст методики и положение модели можно посмотреть в рейтинге COMRAD404. Ссылка ведёт на общий рейтинг, а не заменяет проверку модели на вашей коллекции задач.

Разбор пяти суббаллов

Суббалл Оценка Вес Редакционная интерпретация
Quality 50,0 из 100 0,40 Базовая оценка качества без выраженного преимущества в паспорте
Human preference 87,5 из 100 0,30 Сильное восприятие ответов пользователями в слепых сравнениях
Coding 50,0 из 100 0,15 Нет основания считать модель специализированным инструментом разработки
Efficiency 70,6 из 100 0,10 Хорошее соотношение практической стоимости и заявленного контекстного окна, но скорость не измерена
Access 42,9 из 100 0,05 Доступность ограничивает итоговый профиль, особенно на фоне статуса V2

Наибольший вклад в итоговую оценку дают quality и human preference. У MiMo-V2 Omni они расходятся: 50,0 против 87,5. Это типичный сигнал модели, которую пользователи могут предпочитать за стиль, удобство диалога и способность удерживать задачу, но для которой в редакционном срезе нет достаточного основания говорить о высоком качестве по всему спектру задач.

Efficiency 70,6 выглядит полезно для API-проектов с большими входными документами, однако эту цифру нельзя трактовать как измеренную скорость. В паспорте нет ни output tokens per second, ни time to first token. Доступная цена и большой контекст — разные характеристики, и каждая зависит от условий конкретного провайдера.

Что известно о модели

В официальном релизе Xiaomi MiMo-V2 Omni описывается как omni-modal foundation model, объединяющая текст, зрение и речь. Разработчик отдельно выделяет восприятие изображений, видео и аудио, вызов инструментов, выполнение функций и работу с графическим интерфейсом. Документация по обновлениям фиксирует дату релиза 18 марта 2026 года и максимальный контекст 256K.

Это описание относится к заявлениям разработчика, а не к независимому аудиту. Xiaomi также приводит демонстрационные агентские сценарии: управление браузером, подготовку документов, работу с таблицами и выполнение последовательности действий. Такие примеры полезны для понимания замысла модели, но не заменяют воспроизводимое тестирование на ваших интерфейсах, языках, инструментах и правилах безопасности.

В ходе исследования не найден отдельный публичный model card или репозиторий именно для MiMo-V2 Omni, который раскрывал бы архитектуру, число параметров, тренировочные данные или полный набор воспроизводимых тестов. Наличие репозитория MiMo-V2-Flash не является подтверждением характеристик Omni, поэтому сведения о Flash к этой статье не переносятся.

Возможности и сценарии

Мультимодальные ассистенты

Модель подходит для интерфейсов, где пользователь прикладывает скриншот, фотографию, запись разговора или другой медиаматериал и ожидает текстовое действие: объяснение, классификацию, извлечение полей или подготовку следующего шага. Особенно естественны сценарии поддержки, анализа документов, визуального контроля и обработки входящих обращений.

Агентские цепочки

Заявленные tool invocation, function execution и GUI operation позволяют использовать модель как компонент агента. Она может получать описание доступных функций, выбирать инструмент, обрабатывать результат и продолжать диалог. На практике надёжность зависит не только от модели, но и от схемы функций, валидации аргументов, таймаутов, повторных попыток и разрешений.

Документы и офисная автоматизация

Большое контекстное окно удобно для длинных инструкций, нескольких документов и переписки, которую нужно свести в единый результат. Модель можно проверить на создании структуры отчёта, извлечении данных из PDF, подготовке таблицы или формировании презентационного плана. Финальную проверку чисел, ссылок и форматирования всё равно стоит оставлять за человеком или отдельным валидатором.

Голосовые и визуальные интерфейсы

Официальное позиционирование включает речь и зрение, поэтому MiMo-V2 Omni логично тестировать в голосовых помощниках, мультимодальных чатах, навигации по интерфейсу и обработке видеофрагментов. Не следует автоматически считать её заменой специализированной ASR- или TTS-модели: паспорт подтверждает модальности Omni, но не содержит независимых показателей распознавания и синтеза речи.

Кому модель подойдёт

MiMo-V2 Omni рационально рассматривать командам, которым нужна одна точка входа для текста и медиа, а также возможность подключить функции или браузерные действия. Низкая входная цена делает её интересной для массовых запросов с большим объёмом контекста, если фактический провайдер продолжает обслуживать эту модель или предлагает совместимый маршрут.

Для прототипа продукта модель может быть удобной: сначала вы проверяете восприятие изображений и аудио, затем добавляете структурированный вывод и вызов инструментов. Хороший human-preference суббалл указывает на потенциал комфортного диалога, но не отменяет измерения точности, устойчивости к инструкциям и доли ошибочных действий.

Модель менее очевидна для задач, где главным критерием является генерация и исправление кода. Coding суббалл равен 50,0, а отдельные кодовые рейтинги LMArena в паспорте отсутствуют. Это не доказательство слабости в любом программировании, но достаточная причина не выбирать её для инженерного контура без сравнительного пилота.

Цена и скорость

В паспорте зафиксированы 0,4 доллара за миллион входных токенов и 2 доллара за миллион выходных. Если условно обработать 10 миллионов входных и 1 миллион выходных токенов, расчётная стоимость составит 6 долларов по этим ставкам: 4 доллара за вход и 2 доллара за выход. Это только арифметическая иллюстрация без учёта кэширования, минимальных списаний, мультимодальных единиц, лимитов и политики конкретного API.

Скорость генерации и задержка первого токена в срезе не указаны. Нельзя подставлять сюда показатели других моделей MiMo или рекламные значения платформы. На фактический отклик влияют регион, нагрузка, длина контекста, потоковая выдача, провайдер, режим маршрутизации и формат входных данных.

Отдельный риск связан с жизненным циклом. В официальной документации Xiaomi от 15 июля 2026 года указано, что mimo-v2-omni был официально deprecated 30 июня 2026 года с рекомендацией переходить на новую серию. Поэтому перед интеграцией нужно проверить, принимает ли текущий endpoint именно канонический идентификатор, куда он маршрутизируется и сохраняются ли заявленные ставки. Цена из паспорта не является гарантией будущего тарифа.

Ограничения

  • Доступность. Депрекация V2 снижает предсказуемость долгосрочной интеграции. Нужен план миграции и тест совместимой замены.
  • Закрытая модель. Лицензия указана как Proprietary, open weights отсутствуют. Нельзя рассчитывать на самостоятельное локальное развёртывание по открытому чекпойнту.
  • Нет speed-метрик. В паспорте отсутствуют output tokens/s и TTFT, поэтому SLA по задержке нельзя вывести из рейтинга.
  • Нет Artificial Analysis Index. Показатель отсутствует; не стоит заменять его LMArena rating или COMRAD Score.
  • Нет code-рейтинга LMArena. Coding суббалл есть, но отдельные raw-данные по кодовой категории не зафиксированы.
  • Мультимодальность не равна безошибочности. Изображения, речь и видео могут содержать неоднозначности, шум, мелкий текст и чувствительные данные.
  • Агентские действия требуют ограничений. Браузер, файловая система, платежи и внешние сервисы должны работать через разрешённые инструменты с журналированием и подтверждением опасных операций.
  • Официальные демонстрации не заменяют независимый тест. Заявленные сценарии Xiaomi следует считать описанием возможностей разработчика, а не универсальной гарантией результата.

Как проверить на своей задаче

Начните не с общего впечатления от чата, а с набора из 50–100 реальных примеров. Разделите их на текстовые, визуальные, аудио- и агентские задачи. Для каждого примера заранее определите эталонный ответ, допустимые варианты, критические ошибки и максимальное время выполнения.

  1. Зафиксируйте вход. Сохраните одинаковые инструкции, изображения, документы, аудиофрагменты и версии инструментов. Для длинного контекста отдельно отметьте размер в токенах.
  2. Разделите режимы. Сравнивайте обычный ответ, структурированный JSON, вызов функции и последовательность нескольких инструментов как разные тесты.
  3. Измеряйте качество. Считайте точность извлечения, полноту, ошибки фактов, корректность формата и долю ответов, требующих ручной правки.
  4. Проверьте устойчивость. Повторите часть запросов с переставленными данными, шумом на изображении, неполной информацией и конфликтующими инструкциями.
  5. Проверьте агента. Ограничьте доступ, используйте песочницу и заранее подготовленные фиктивные сервисы. Считайте неверные вызовы, пропущенные шаги, повторы и опасные действия.
  6. Измерьте экономику. Запишите входные и выходные токены, стоимость, долю повторных запросов и среднее время ответа у фактического провайдера. Отсутствующие в паспорте speed-метрики получите самостоятельно.
  7. Проверьте миграцию. До запуска убедитесь, что API не перенаправляет V2 на другую модель незаметно. Сохраните тесты, чтобы сравнить результат после изменения маршрута.

Минимальный критерий выбора — не максимальный единичный результат, а приемлемая доля успешных ответов при предсказуемой цене и безопасном поведении. Для клиентского продукта полезно отдельно провести слепую оценку: пусть несколько пользователей сравнят ответы MiMo-V2 Omni с текущей моделью без знания названий. Это лучше связывает высокий human-preference суббалл с вашей аудиторией.

Итоговая оценка

MiMo-V2 Omni — интересный, но переходный вариант мультимодального API. Её профиль строится вокруг удобства взаимодействия и поддержки текста, зрения и речи, а не вокруг доказанной специализации в программировании или прозрачной локальной эксплуатации. Сильный human preference 87,5 и умеренная efficiency 70,6 делают модель привлекательной для ассистентов и недорогих прототипов. COMRAD Score 63,0 и 65-е место одновременно напоминают: универсальность заявлена, но общий баланс не относится к верхней части рейтинга.

Главный практический вопрос на 31 августа 2026 года — не только «насколько хорошо отвечает модель», но и «какой именно endpoint вы получите». Из-за официальной депрекации V2 MiMo-V2 Omni стоит внедрять только с проверкой фактической маршрутизации и заранее подготовленным сценарием перехода. Для эксперимента и ограниченного API-проекта это может быть оправданный выбор; для долгого production-контракта решение следует принимать только после проверки доступности, цены, задержки и качества на собственных данных.

FAQ

Что такое MiMo-V2 Omni?

Это мультимодальная модель Xiaomi, официально позиционируемая для работы с текстом, изображениями, видео, речью, инструментами и агентскими действиями. В паспорте указан контекст 262 144 токена.

Какое место MiMo-V2 Omni занимает в рейтинге COMRAD404?

Модель занимает 65-е место в редакции 2026 H2 и получает COMRAD Score 63,0 из 100. Это нормализованная редакционная оценка, а не процент качества.

В чём её главный плюс?

Главное преимущество профиля — высокий human-preference суббалл 87,5 из 100. Текстовая LMArena-оценка составляет 1430,4 при 19 421 голосе; это статистический рейтинг попарных сравнений, а не доля правильных ответов.

Сколько стоит MiMo-V2 Omni?

В паспорте указаны 0,4 доллара за миллион входных токенов и 2 доллара за миллион выходных. Эти ставки зависят от API-провайдера, режима и доступности конкретного идентификатора и не должны восприниматься как неизменные.

Известна ли скорость модели?

Нет. В зафиксированном срезе отсутствуют и output tokens per second, и time to first token. Их нужно измерить самостоятельно на выбранном endpoint.

Можно ли запустить модель локально?

Паспорт указывает Proprietary и отсутствие open weights. Публичного открытого чекпойнта именно MiMo-V2 Omni в исследовании не найдено, поэтому локальное развёртывание по весам не подтверждено.

Стоит ли использовать модель в production?

Только после пилота и проверки жизненного цикла. Официальная документация Xiaomi сообщает о депрекации моделей V2 с 30 июня 2026 года, поэтому для production обязательны проверка маршрутизации, контроль стоимости и план миграции.

Источники