Meta* впервые стала иметь вес в направлении кодинга, выпустив сразу два продукта:

  • Muse Spark 1.2 — представителя нового поколения reasoning-моделей, заточенного под программирование;

  • Muse Code — кодинг-агента, который предназначен для написания программ и разработки ПО и работающего поверх Muse Spark 1.2.

Ниже разберем, насколько честны бенчмарки новой модели, почему Meta* умалчивает об успехах китайских конкурентов и как их новая стратегия монетизации может изменить рынок ИИ-разработки.

Бенчмарки и особенности модели Muse Spark 1.2 

Рассмотрим сначала Muse Spark. Бенчмарки, как обычно, радуют, но все ли так идеально? По самому главному бенчу для агентной разработки, Terminal Bench, модель от Meta* стоит на втором месте после Claude Opus 5. Тем самым компания заявляет, что почти обогнала главного лидера гонки. От остальных бенчей ощущается такое же сообщение – мы догоняем вас.

Бенчмарки Muse Spark и других соперников.
Бенчмарки Muse Spark и других соперников. Источник.

Но почему в сравнении не указаны китайские партнеры? Почему нет Qwen3.8-Max?
А потому, что включи они в сравнение поделку от Alibaba, Muse Spark 1.2 ушла бы на третье место.

Бенчмарки Qwen3.8-Max.
Бенчмарки Qwen3.8-Max. Источник.

Тут маркетинговый нарратив рушится, и Spark 1.2 будет подан не в таком уж победоносном виде. 

Рассматривая синтетические бенчмарки, которые всегда будут отличаться от реальных, все же хочется сделать вывод, что Meta* хочет выставить себя под нужным углом, не сравнивая себя с китайскими гигантами и их моделями.

Теперь рассмотрим сам Muse Spark 1.2. Модель спроектирована как LLM для автономных агентов, и вот почему:

  • Оркестрация мультиагентных систем. Можно создать команду из четырех агентов с разными ролями, способную превратить одну строку описания в реальный продукт;

  • Параллельный запуск агентов. Запуск нескольких субагентов в изолированных средах параллельно;

  • Управление компьютером. Предоставив Muse Spark управление агентом, можно создавать программное обеспечение (но подумайте дважды о последствиях);

  • Агент для GitHub. Есть возможность создать автономного бота для GitHub на базе Meta Model API с использованием Muse Spark и OpenCode;

  • Привязка к поиску. Обеспечив модели доступ к актуальным данным из интернета, можно получать информацию в режиме реального времени.

Все пункты явно указывают именно на расширенное взаимодействие модели с агентами.

ИИ‑роутер — доступ к 300+ моделям из одной панели

Подключите OpenAI‑совместимый шлюз по единому API‑ключу. Настраивайте сквозную аналитику, отслеживайте лимиты и квотируйте ресурсы.

Запустить ИИ‑роутер →

Ваши данные не только в ваших руках. Сделка с Цукербергом

По заявленной в анонсе информации, есть два вида оплаты за использование модели. 

Цена за использование Muse Spark 1.2.
Цена за использование Muse Spark 1.2. Источник.

Обычная версия muse-spark-1.2 стоит в 20 раз дороже, чем версия Contributor. И это не просто аттракцион невиданной щедрости. Если пользователь разрешает использовать свои данные для последующего обучения модели, его модель оплаты меняется, и платить теперь нужно заметно меньше. Такой честности и стратегии монетизации я еще не видел, обычно данные собираются тайно, а пользователь может быть не в курсе, что за счет его общения с моделью формируется дата-сет.

Muse Code — инженерный агент

По своей архитектуре Muse Code является агентом, который способен планировать и поочередно закрывать задачи, работать с репозиториями, запускать команды в терминале, писать тесты и доводить продукт до рабочего состояния. 

Как ранее говорилось, Muse Code работает в тесной связке с Muse Spark. Два решения могут полностью автоматизировать цикл разработки — от создания задач и продумывания архитектуры до написания тестов и отладки продукта. 

В числе заявленных возможностей агента, который работает вместе с LLM:

  • постановка задач, планирование изменений перед началом действий;

  • работа с крупными проектами и кодовыми базами. Контекстное окно в 1 млн токенов это позволяет;

  • запуск нескольких агентов одновременно для параллельного выполнения частей задачи;

  • написание тестов и выполнение команд в терминале.

Выводы по модели и агенту

Meta* ворвалась в гонку профильных ИИ-агентов, специализирующихся на написании ПО. Muse Spark 1.2 показывает неплохие результаты на бенчмарках, а Muse Code дополняет модель агентными технологиями. Вышедшие продукты, заточенные под автономную разработку и агентный подход, заставляют обращать внимание на нового участника. 

*Признана в России экстремистской организацией, а ее деятельность запрещена на территории страны решением Тверского районного суда Москвы от 21 марта 2022 года.

Комментарии (14)


  1. aikendo
    06.08.2026 15:16

    Spark - прекрасная модель, но обсуждать ее вам - глупое решение.
    Ее нельзя использовать в России по причине, что это значит платить деньги компании Цекерберга, а платить - значит спонсировать. О последствиях понимаете интересно?
    Вот тогда вообще зачем писать, чтобы хайпануть чтоли? Вы же ее даже протестировать не можете, а пользователи ее не смогут использовать.


    1. Vedomir
      06.08.2026 15:16

      Не совсем понятно, за что минусуют. Это вполне реальные специфические риски работы в России.


      1. aikendo
        06.08.2026 15:16

        Спасибо большое за поддержку


        1. Vedomir
          06.08.2026 15:16

          Вместе с тем я бы заметил, что далеко не все читатели Хабра живут в России и мне статью было интересно почитать просто саму по себе, даже если я не буду эту модель использовать.

          Так что ваши претензии именно в таком эмоциональном формате тоже спорные (а любая политика на Хабре это всегда большой риск). Как максимум в статье стоило бы упомянуть специфические российские проблемы с этой моделью. Ну ладно, вы их упомянули в комментариях.


    1. Dimmirslr
      06.08.2026 15:16

      Доступ к таким моделям легко покупается через агрегаторы API в дружественных юрисдикциях. Прямая оплата корпорации в текущих реалиях вообще не обязательна


  1. ggeorgiykolpakov
    06.08.2026 15:16

    А почему они китайцев не указали в сравнении? Потому что тогда бы их обогнали, и весь пафос сдулся


    1. Flampanzer Автор
      06.08.2026 15:16

      Конечно. уже громогласно не заявишь о себе. Да и в мире ИИ бенчи играют свою роль, нужно показать себя с выгодной стороны.


  1. Hait
    06.08.2026 15:16

    Почему на графиках сравнение с 5.6 Terra, а не sol?


    1. aikendo
      06.08.2026 15:16

      Потому-что по стоимости надо сравнивать, где 4 бакса и 30 баксов


      1. Hait
        06.08.2026 15:16

        Так и у Opus 5.0 цена будет 25 долларов


    1. Flampanzer Автор
      06.08.2026 15:16

      график взял из их официального сайта


      1. Hait
        06.08.2026 15:16

        Это не претензия к новости, больше вопрос "почему они тестировали не с sol".

        Извиняюсь, что так плохо вопрос поставил


        1. Flampanzer Автор
          06.08.2026 15:16

          не, все ок, я так и понял, что вы претензии имеете к этим сравнителям)
          оправдания могут быть самые разные у них)


  1. Dimmirslr
    06.08.2026 15:16

    Найс план отдать Цукербергу все свои исходники за скидку на API. Завтра он на твоем же коде обучит Muse 2.0 и продаст его твоему конкуренту