Close

Xiaomi AI и Xiaomi LLM: всё, что нужно об этом знать

Команду разработчиков, ответственную за ИИ решения, возглавляет Ло Фули, который перешел в Xiaomi из DeepSeek.

Справка
621
14.06.26
Xiaomi AI и Xiaomi LLM: всё, что нужно об этом знать

Изображение: открытые источники

Компания Xiaomi всегда славилась доступными смартфонами и гаджетами для умного дома. Но за последние полтора года компания незаметно превратилась в одного из самых амбициозных игроков на рынке искусственного интеллекта в мире.

От масштабных языковых моделей и клонирования голоса до автономного телефонного агента и огромных инвестиционных фондов — Xiaomi стремительно развивается. Вот всё, что вам нужно знать о положении Xiaomi в большой гонке за лидерство в области ИИ и языковых моделей.

Как Xiaomi достигла получения лицензии LLM?

История развития искусственного интеллекта в Xiaomi по-настоящему началась в апреле 2025 года, когда компания выпустила MiMo-7B, свою первую открытую языковую модель. Для тех, кто не в курсе, название «MiMo» расшифровывается как Xiaomi Model (Mi и Mo). С самого начала хорошо то, что Xiaomi фокусируется на логическом мышлении и программировании, а не просто на общении.

Несмотря на наличие всего 7 миллиардов параметров, Xiaomi заявила, что MiMo-7B показала результаты значительно выше своих возможностей. В математических тестах, таких как MATH-500, версия модели с подкреплением набрала 95,8%. Удивительно, но она также превзошла o1-mini от OpenAI и Qwen-32B-Preview от Alibaba на математических соревнованиях AIME 2024 и 2025.

Модель была обучена на специально подобранном наборе данных, содержащем 200 миллиардов логических токенов, всего 25 триллионов токенов, распределенных на три этапа обучения. Xiaomi выпустила её под открытой лицензией MIT, и она доступна на Hugging Face.

К слову, команду разработчиков Xiaomi, ответственную за ИИ решения, возглавляет Ло Фули, который перешел в Xiaomi из DeepSeek.

MiMo-V2-Flash

К декабрю 2025 года Xiaomi анонсировала MiMo-V2-Flash — модель с 309 миллиардами параметров, большая часть весовых коэффициентов которой оставалась «неактивной». То есть, благодаря архитектуре Mixture-of-Experts (MoE), одновременно можно было использовать только около 15 миллиардов параметров.

Её отличительной чертой стало сочетание производительности и скорости. Она заняла второе место среди моделей с открытым исходным кодом в тестах на логическое мышление, сравняласьс GPT-5 и Claude 4.5 Sonnet в тестах на разработку программного обеспечения (SWE-Bench Verified) и мог генерировать ответы со скоростью 150 токенов в секунду, при этом, по сообщениям, стоимость его работы составляла всего 2,5% от стоимости логического вывода Claude.

В MiMo-V2-Flash также была представлена ​​технология прогнозирования нескольких токенов (MTP), которая позволяет модели генерировать и проверять несколько токенов одновременно.

MiMo-V2-Pro: Флагман с триллионом параметров

В марте 2026 года Xiaomi представила свою самую амбициозную модель. MiMo-V2-Pro имеет более триллиона параметров и обрабатывает 42 миллиарда активных параметров за один проход. Она поддерживает контекстное окно в миллион токенов, что означает, что она может обрабатывать эквивалент нескольких длинных романов в одном разговоре.

Xiaomi заявляет, что модель специально создана для «агентных» задач: сложных многоэтапных заданий, требующих планирования и выполнения без постоянного участия человека.

На самом деле, эта модель впервые появилась на платформе OpenRouter, шлюзе для ИИ, будучи загруженной анонимно под названием «Hunter Alpha». Она быстро взлетела на вершину рейтинга, обработав более 1,5 триллиона токенов, прежде чем Xiaomi официально присвоила себе авторство.

Наряду с MiMo-V2-Pro, Xiaomi также выпустила две сопутствующие модели: MiMo-V2-Omni (мультимодальная версия, способная обрабатывать текст, изображения, аудио и видео) и MiMo-V2-TTS (модель преобразования текста в речь для конвейера обработки сообщений агента).

MiMo-V2.5 и V2.5-Pro

В конце апреля 2026 года Xiaomi объединила лучшие возможности семейства V2 в единую архитектуру. MiMo-V2.5-Pro ​​— это модель с 1,02 триллионом параметров, которая обрабатывает текст, изображения, аудио и видео одновременно. Она работает со скоростью от 60 до 80 токенов в секунду для сложных задач, в то время как более легкая MiMo-V2.5 (для повседневного использования) достигает скорости от 100 до 150 токенов в секунду.

На момент запуска V2.5-Pro ​​также занимала первое место в мире среди моделей с открытым исходным кодом по возможностям агентного анализа в бенчмарке Artificial Analysis.

Xiaomi также отменила дополнительные сборы за использование полного контекстного окна с 1 миллионом токенов и обнулила пользовательские кредиты при запуске, что сделало сервис более удобным для разработчиков.

А совсем недавно, в начале июня 2026 года, Xiaomi выпустила MiMo Code — терминала для программирования с использованием искусственного интеллекта на базе MiMo-V2.5. В отличие от большинства помощников по программированию, которые забывают контекст, как только окно заполняется, MiMo Code использует систему постоянной памяти, которая отслеживает принятые решения на протяжении длительных проектов.

MiMo-VL

Что касается визуальной составляющей, Xiaomi выпустила MiMo-VL (Vision-Language) и его ориентированный на дом вариант, MiMo-VL-Miloco-7B. Модель Miloco разработана для понимания домашней обстановки.

Она способна распознавать повседневные жесты, такие как поднятый большой палец, «ОК», знак мира и открытые ладони, а также определять распространенные бытовые занятия, такие как просмотр телевизора, тренировка или чтение.

В основе этой модели лежит сочетание контролируемой тонкой настройки и обучения с подкреплением, что позволяет сохранить «умные» возможности модели, не теряя при этом ее общих характеристик.

MiDashengLM-7B

Выпущенная в августе 2025 года, MiDashengLM-7B — это аудио-ИИ-модель от Xiaomi. В отличие от большинства голосовых ИИ-систем, которые обучаются в основном на распознавании речи (что отбрасывает большую часть невербальной аудиоинформации), эта модель использует подход «общего аудиоконтента».

Она была обучена на огромном наборе данных объемом 38 662 часа и может понимать не только слова, но и музыку, звуки окружающей среды, эмоции говорящего и акустический контекст.

MiMo-Audio: Слух в больших масштабах

Наряду с разработкой визуальной и языковой модели, Xiaomi также выпустила MiMo-Audio — отдельную аудио-языковую модель. Аудиокодер из MiMo-Audio позже был интегрирован в MiMo-V2.5 для обеспечения возможности работы в многомодальном режиме.

OmniVoice: клонирование любого голоса на любом языке

Модель клонирования голоса Xiaomi Omnivoice с открытым исходным кодом
Одним из самых впечатляющих недавних релизов Xiaomi является OmniVoice , модель преобразования текста в речь от команды Kaldi следующего поколения из лаборатории искусственного интеллекта Xiaomi, открытый для публичного доступа в мае 2026 года.

OmniVoice поддерживает 646 языков, включая множество языков с ограниченными ресурсами, для которых доступно очень мало обучающих данных. Это модель клонирования голоса с нулевым количеством примеров, что означает, что она может клонировать голос всего из нескольких секунд эталонного аудио и генерировать естественную речь на разных языках, сохраняя при этом исходные характеристики голоса.

Технически OmniVoice отличается упрощенной архитектурой с одним преобразователем, которая напрямую сопоставляет текст с акустическими токенами. Это позволяет завершить обучение на 100 000 часах аудиоданных за один день и выполнять вывод с частотой до 40 раз выше, чем в реальном времени, используя PyTorch.

Xiaomi заявляет, что OmniVoice — это первая модель синтеза речи с клонированием, поддерживающая сотни языков. Она также имеет удобные инструменты для исправления сложных произношений, например, полифонических китайских иероглифов или редких английских имен собственных. Все это доступно под лицензией Apache-2.0.

MiMo-V2.5-TTS и ASR: полноценный голосовой конвейер

Одновременно с более широким запуском версии V2.5 компания Xiaomi также выпустила MiMo-V2.5-TTS и систему автоматического распознавания речи (ASR) .

Модель TTS поддерживает клонирование голоса, а система автоматического распознавания речи (ASR) обрабатывает двуязычное распознавание. Вместе они позволяют разработчикам создавать комплексные продукты с голосовым управлением, не прибегая к объединению инструментов от разных поставщиков.

Xiao AI и HyperAI: сторона, ориентированная на потребителя

Что касается потребительского сегмента, Xiaomi предлагает два основных варианта использования искусственного интеллекта для обычных пользователей.

Xiao AI (小爱) — это давно существующий голосовой помощник Xiaomi, доступный на смартфонах, умных колонках и носимых устройствах. В HyperOS 2 он был обновлен и стал «Super Xiao AI» с улучшенной контекстной памятью, более интеллектуальным управлением домашними устройствами и возможностью генерировать изображения из текста. Он глубоко интегрирован в трехкомпонентную систему HyperOS: HyperCore для производительности, HyperConnect для синхронизации устройств и HyperAI для интеллектуальных функций.

HyperAI, представленный на MWC 2025 и внедренный в телефоны, начиная с серии Xiaomi 15, представляет собой набор функций искусственного интеллекта, встроенных в HyperOS 2. Он включает в себя перевод в реальном времени, помощь в написании текста с помощью ИИ, интеллектуальное распознавание речи, которое суммирует записи, и редактирование фотографий с помощью ИИ.

Для глобальных устройств Xiaomi также интегрировала Google Gemini в качестве бэкэнда. С тех пор HyperAI распространился и на устройства среднего ценового сегмента, включая Redmi Note 14 Pro+ 5G и серию Poco.

Xiaomi miclaw: Искусственный интеллект, который делает за вас дела

Наиболее перспективным элементом в головоломке искусственного интеллекта Xiaomi является miclaw. Анонсированный в марте 2026 года и в настоящее время находящийся в закрытом бета-тестировании, miclaw не является чат-ботом. Это автономный агент искусственного интеллекта, построенный на платформе MiMo.

Вместо того чтобы просто отвечать на вопросы, miclaw интерпретирует ваши желания, а затем фактически выполняет их. Он может открывать приложения, перемещаться по интерфейсам, заполнять формы, взаимодействовать с системными инструментами и выполнять многоэтапные задачи на вашем телефоне, и все это без вашего участия.

Это работает благодаря тому, что Xiaomi называет «циклом вывода-выполнения»: ИИ определяет, что нужно сделать, выполняет это, проверяет результаты и продолжает работу до тех пор, пока задача не будет выполнена.

Miclaw также обладает контекстной памятью, которая сжимает старые взаимодействия, сохраняя при этом первоначальное предназначение задачи. Он также может подключаться к более широкой экосистеме умного дома и автомобиля Xiaomi.

Что касается конфиденциальности, Xiaomi заявляет, что взаимодействие пользователей с miclaw не используется для обучения моделей ИИ. Персональные данные обрабатываются в режиме реального времени только для выполнения команд, а конфиденциальная информация обрабатывается локально на устройстве с помощью того, что Xiaomi описывает как «граничные облачные вычисления для обеспечения конфиденциальности».

Miclaw также был протестирован в качестве голосового помощника для умных часов, работающего через приложение Xiaomi Health. Пользователи нажимают и удерживают кнопку, чтобы произнести ответ, который обрабатывается подключенным телефоном и отображается на часах.

Деньги, стоящие за всем этим

В марте 2026 года основатель Xiaomi Лэй Цзюнь объявил, что компания инвестирует не менее 8,7 миллиардов долларов в искусственный интеллект в течение следующих трех лет. Это в дополнение к уже растущим бюджетам компании на НИОКР. В результате прогнозируется, что ежегодные расходы Xiaomi на НИОКР достигнут около 40 миллиардов юаней (5,7 миллиардов долларов) в 2026 году.

Результаты становятся очевидными. К началу апреля 2026 года модели Xiaomi захватили около 21% всего трафика на OpenRouter, платформе маршрутизации на основе искусственного интеллекта. Лэй Цзюнь также заявил, что компания стремится к «грандиозной конвергенции» в 2026 году , объединив собственный чип, собственную операционную систему и собственную модель искусственного интеллекта в одном устройстве.

Что всё это значит?

Двенадцать месяцев назад у Xiaomi не было общедоступных моделей ИИ. Сегодня у компании есть полный набор инструментов: модели для рассуждений, модели для обработки изображений и языка, аудиомодели, система клонирования голоса, конвейер обработки текста и речи, агент ИИ и функции ИИ для потребительских устройств, доступные на миллионах устройств.

Темпы разработки и выпуска этих моделей Xiaomi, мягко говоря, поразительны. А тот факт, что большинство из них имеют открытый исходный код, помогает Xiaomi быстро наращивать потенциал среди разработчиков.

Главное испытание впереди — смогут ли miclaw и HyperOS 4 сделать весь этот ИИ действительно полезным в повседневной жизни людей. Если смогут, Xiaomi перестанет быть просто компанией, занимающейся разработкой ИИ в свободное время, а станет настоящей платформой искусственного интеллекта.

Чтобы оперативно узнавать новости, информацию о свежих обновлениях HyperOS и системных приложений, а также получать новые инструкции и справочные материалы, подпишись на наш Telegram-канал. Будь в курсе!

P.S. Другие полезные инструкции и рекомендации по настройке системы HyperOS от Xiaomi, мануалы по изменениям, а также информацию о нововведениях в свежих обновлениях HyperOS можно посмотреть в этом разделе.

По материалам из открытых источников
scroll to top