Xiaomi внезапно представила MiMo-2.6 — открытую модель, которая претендует на место среди самых сильных ИИ для агентных задач. По словам разработчиков, версия Pro в большинстве таких бенчмарков работает на уровне Claude Opus 5 и GPT-5.6 Sol, а в Artificial Analysis Intelligence Index набрала 46 баллов.

В основе MiMo-2.6 лежит архитектура MoE: всего модель содержит 1,02 млрд параметров, из которых 42 млрд активируются во время работы. Она использует гибридное внимание и пятислойный MTP-декодер. Такой подход позволяет модели заранее предполагать несколько следующих токенов и параллельно проверять их, ускоряя генерацию.

Контекст MiMo-2.6 достигает 1 млн токенов, а сама модель изначально мультимодальная. Но особенно интересно то, как Xiaomi масштабировала обучение с подкреплением. Для кодинга, работы со зрением и CFT-задач разработчики использовали 750 000 RL-траекторий, полностью асинхронный GRPO и более 7000 RL-окружений для агентов, которые также открыли в исходном коде.

При этом обучение, по данным Xiaomi, обошлось всего в $3 млн. Разработчики связывают такую стоимость с использованием проверяемых задач, для которых не требовалась ручная разметка.

Цены на API тоже заметно ниже уровня многих флагманских моделей. MiMo-2.6 Pro стоит $0,435 за миллион входных токенов и $0,87 за миллион выходных, а Flash — $0,14 и $0,28 соответственно.

Если заявленные результаты подтвердятся независимыми тестами, MiMo-2.6 может серьёзно усилить позиции открытых моделей в агентных сценариях. А сочетание большого контекста, мультимодальности и низкой стоимости делает её особенно интересной для разработчиков, которые хотят запускать сложные ИИ-системы без огромных расходов.