MiMo Code обновилась до v0.1.12, но победа над Claude Code всё ещё не независима

MiMo Code продолжила развиваться после июньского открытия кода: на 14 августа актуальным выпуском является v0.1.12, опубликованный 13 августа. Однако обновление не превратило громкое сравнение с Claude Code в независимо подтверждённый результат: журнал выпусков MiMo Code показывает быстрый переход от v0.1.0 к v0.1.12, но не содержит нового внешнего исследования производительности.
Поэтому центральный вывод остаётся осторожным: Xiaomi действительно открыла исходный код работающего терминального ИИ-агента и продолжает его обновлять, но «победа» в заданиях длиннее 200 шагов — заявление разработчика. Как отмечал разбор The New Stack, сравнение опиралось на внутреннюю бета-версию и оценку с участием 576 разработчиков, а отдельного стороннего прогона не было.
Что именно выпустила Xiaomi
MiMo Code — терминальный помощник для программирования, созданный командой Xiaomi MiMo на основе OpenCode. Он умеет читать и изменять файлы, выполнять команды, работать с Git и подключаться к разным поставщикам языковых моделей. Исходный код распространяется по лицензии MIT, хотя использование размещённых сервисов Xiaomi регулируется отдельными условиями.
Главная инженерная идея продукта — отделить выполнение задания от сохранения состояния. Основной агент занимается кодом, а вспомогательный компонент записывает контрольные точки, проектные сведения и ход задачи. При возобновлении сеанса эти данные возвращаются в контекст, чтобы системе не приходилось заново восстанавливать устройство репозитория только по обрезанной истории диалога.
В текущей документации перечислены четыре вида локальных данных: проектная память, контрольная точка сеанса, временные заметки и журналы отдельных задач. Для поиска применяется SQLite FTS5. Это не бесконечное контекстное окно в буквальном смысле, а инженерный способ вынести часть накопленных сведений из запроса к модели и затем выборочно вернуть их.
Что на самом деле показало сравнение с Claude Code
Xiaomi сравнивала не только разные модели, но и управляющие оболочки — наборы инструментов, правил и механизмов, которые превращают языковую модель в действующего агента. В контролируемом испытании одна и та же MiMo-модель работала через MiMo Code и Claude Code, поэтому результат относился именно к двум конфигурациям, а не доказывал превосходство модели Xiaomi над моделью Anthropic.
Официальное описание запуска Xiaomi сообщает результаты 62% против 57% на SWE-bench Pro и 73% против 68% на Terminal Bench 2 при использовании одной модели в разных оболочках. Там же компания связывает разницу с собственной системой управления заданиями и режимом Compose, который разделяет работу на проектирование, планирование, написание кода, тестирование и проверку.
Числа подтверждают более узкий тезис, чем предполагает формулировка «MiMo Code обошла Claude Code». Они показывают преимущество выбранной Xiaomi связки при заданных настройках и методике. Без опубликованного независимого воспроизведения нельзя переносить этот вывод на любые репозитории, модели, версии Claude Code и типы задач.
Отдельное пользовательское сравнение относилось к длительным траекториям. По заявлению Xiaomi, после отметки в 200 шагов доля предпочтений MiMo Code превышала 65%, тогда как на более коротких заданиях разрыв был меньше. Но количество шагов само по себе не измеряет качество: один агент может делать больше мелких вызовов инструментов, а другой — объединять операции, поэтому особенно важны одинаковые исходные условия, критерий завершения и проверка конечного кода.
Почему длинные задания требуют другой архитектуры
Во время продолжительной работы агенту необходимо помнить принятые решения, не повторять уже проверенные гипотезы и замечать, когда очередное изменение ломает предыдущий результат. Чем длиннее цепочка действий, тем выше риск, что важная деталь исчезнет после сокращения контекста или останется только в неструктурированном журнале терминала.
MiMo Code пытается уменьшить этот риск с помощью автоматических контрольных точек. Состояние сохраняет отдельный вспомогательный агент, а команда Dream перерабатывает накопленную историю в более компактную долговременную память. Команда Distill ищет повторяющиеся рабочие процедуры и предлагает оформить их как повторно используемые навыки, команды или вспомогательных агентов.
Такой подход важен для всего рынка агентного программирования: результат зависит не только от качества генерации следующего фрагмента кода. На длинной дистанции не менее существенны управление контекстом, проверка промежуточных результатов, разрешения на выполнение команд и способность восстановиться после ошибки. Публикация исходного кода позволяет разработчикам изучать эти механизмы и сравнивать их на собственных воспроизводимых заданиях.
Что изменилось к августу
За два месяца проект получил двенадцать выпусков ветки 0.1. В v0.1.11 появился переключатель, который запрещает запись новой памяти, сохраняя возможность поиска по уже накопленным данным; разработчики одновременно уточнили, что при таком режиме существующая память не загружается автоматически. Версия v0.1.12 добавила новые изменения в работе разрешений, обработке перегрузки GPT-сервера и защите учётных данных дочерних процессов.
Обновился и коммерческий контекст. Ограниченный бесплатный доступ к MiMo-V2.5 завершился 26 июля, после чего для этой серии потребовалась подписка Xiaomi либо собственный ключ API. Сам открытый клиент при этом не исчез: его можно установить из опубликованных сборок или npm и подключить к совместимому поставщику модели.
Практический смысл обновления не в том, что MiMo Code теперь бесспорно лучше Claude Code. Проект остаётся молодой веткой 0.1, активно меняется и уже исправлял проблемы безопасности, памяти и совместимости инструментов. Его сильная сторона — доступная для изучения архитектура долгих сеансов; слабая сторона исходного сравнения — отсутствие независимого воспроизведения заявленного преимущества после 200 шагов.
Как оценивать заявление о превосходстве
Для содержательного сравнения двух агентов недостаточно дать им похожие текстовые задания. Нужны одинаковый снимок репозитория, одна и та же модель там, где проверяется оболочка, зафиксированные разрешения и лимиты, автоматические тесты результата, учёт стоимости и полный журнал вызовов инструментов. Отдельно следует различать успешно завершённую задачу и субъективное предпочтение разработчика.
MiMo Code уже представляет интерес как открытый эксперимент с постоянной памятью и координацией нескольких агентов. Но корректная формулировка на текущую дату такова: Xiaomi сообщила о преимуществе своей конфигурации в собственных испытаниях, включая задания длиннее 200 шагов, а независимого подтверждения универсальной победы над Claude Code пока нет.
Читайте также:
Подпишитесь на рассылку
Получайте свежие новости Web3, AI и криптовалют прямо на вашу почту.