2 сентября 2026 г.
Лидер по коду сменился: Muse Spark 1.3 от Meta обошла Opus 5 на DeepSWE 1.1
Meta выпустила Muse Spark 1.3 02.09.2026: 75,4 на DeepSWE 1.1 против 74,0 у Opus 5.

🚨 AI News | TestingCatalog
@testingcatalog
META 🔥: Muse Spark 1.3 официально анонсирована и обошла GPT-5.6 и Opus 5 на DeepSWE 1.1! > Muse Spark 1.3 раскатывается на API моделей Meta. > «Watermelon», следующий большой апгрейд моделей Meta, и open-weight версия Muse Spark уже на подходе! Конкуренция накаляется с каждой неделей 👀
Muse Spark 1.3 раскатываем сегодня, и frontier-уровень стоит теперь почти столько, что и считать нечего. Это наш самый большой скачок в коде и агентной работе. Попробуйте в Muse Code и в нашем API. Дальше 🍉 и релиз открытых весов Muse Spark, уже скоро.



· 2,1 тыс. просмотров
Версия 1.2 набирала на том же замере 55,0. Одна версия — плюс 20,4 пункта и первое место.
Для тех, кто платит за агента, меняется арифметика: топовый по коду уровень стоит $1,25 за миллион входных токенов и $4,25 за миллион выходных. Кэшированный вход идёт по $0,15. Есть тариф contributor дешевле, $0,10 за вход и $0,20 за выход, но данные уходят в обучение Meta.
Поставить можно одной командой. `curl -fsSL https://dev.meta.ai/install.sh | bash` ставит CLI-агент Muse Code на macOS или Linux, модель доступна в нём сразу. В API она зовётся `muse-spark-1.3` на base URL `https://api.meta.ai/v1`, а сам эндпоинт понимают OpenAI SDK, Anthropic SDK и совместимые агентные CLI, так что переписывать код не нужно. Окно контекста — 1 048 576 токенов.
Побеждает не везде. На SWEAtlas CodeBase у 1.3 счёт 59,4 против 52,7 у Opus 5 и 53,5 у GPT-5.6 Sol, на Terminal-Bench 2.1 — 88,8 и ничья с GPT-5.6 Sol. Зато на GDPVal-AA v2 у неё 1754 против 1824 у Opus 5, на OSWorld 2.0 счёт 66,9 против примерно 68.
Длинный контекст модель держит лучше конкурентов. MRCR на 256K–512K даёт 98,5, у GPT-5.6 Sol 91,5. На отрезке 512K–1M у 1.3 98,1, у GPT-5.6 Sol 73,8.
По внутренним замерам Meta, на тех же задачах 1.3 делает примерно на 20% меньше вызовов инструментов и тратит на 25% меньше токенов, чем 1.2. Лимиты standard-тарифа — 3 000 запросов и 4 млн токенов в минуту, у contributor 100 запросов и 3 млн токенов, и считаются они на команду, а не на ключ.
Режим max reasoning Meta включит после дополнительных тестов безопасности, открытые веса Muse Spark обещаны без даты.
Первоисточник