Код Muse от Meta проиграл Claude Opus 5 от Anthropic в бенчмарке по программированию с использованием ИИ

iconBeInCrypto
Поделиться
AI summary iconСводка
Новости ИИ и криптовалют: Meta’s Muse Code, запущенный в бета-версии 5 августа 2026 года, проиграл Claude Opus 5 от Anthropic по всем четырем кодировочным тестам, опубликованным Meta. Независимые данные показывают более значительный разрыв, чем сообщалось. Meta не включила GPT-5.6 Sol от OpenAI, которая лидирует в тестах. Данные по инфляции остаются ключевым макрофактором для криптовалютных рынков.

Марк Цукерберг запустил Muse Code в бета-версии в среду — первый искусственный интеллект (ИИ) для написания кода от Meta. Claude Opus 5 от Anthropic превосходит его по всем четырём параметрам, которые Meta опубликовала при запуске.

Meta все равно опубликовала эти графики. Компания продает более дешевый инструмент, а не более качественный. Данные независимых тестов показывают, что разрыв шире, чем показала Meta.

Спонсорство
Спонсорство

Подписывайтесь на нас в X, чтобы получать последние новости в режиме реального времени

Собственные графики Meta передают Anthropic каждый раунд

Muse Spark 1.2 — это модель внутри Muse Code. Она показала результат 82,9% на Terminal-Bench 2.1.

Claude Opus 5 набрал 86,7% на том же тесте. Terminal-Bench разработан исследователями из института Laude и Стэнфордского университета. Он включает 89 реальных задач, охватывающих ремонт систем, работу с данными и безопасность.

Второе место — это уважительный результат. Muse Code опередил Codex от OpenAI с результатом 81,8% и Grok Build с результатом 81,6%.

График сравнения с эталоном для Muse Spark 1.2
График сравнения с эталоном для Muse Spark 1.2, источник: Цукерберг

Следующий график был более суровым. DeepSWE 1.1 включает 113 задач по программированию с отключенным доступом в интернет во время оценки. Muse Spark 1.2 упал на третье место с результатом 59,3%.

Meta затем опубликовала тест, который сама разработала, на основе 440 реальных запросов на извлечение от своих инженеров. Muse Spark 1.2 показала результат 70,6%, что примерно на девять пунктов ниже, чем у Opus 5.

Спонсорство
Спонсорство
Muse Spark 1.2 выполнял задачу оптимизации ядра в течение 24 часов на NVIDIA Hopper — более 1000 вызовов инструментов — и продолжал находить реальные ускорения даже после завершения этапа раннего исследования.
Muse Spark 1.2 выполнял задачу оптимизации ядра в течение 24 часов на NVIDIA Hopper — более 1000 вызовов инструментов — и продолжал находить реальные ускорения даже после завершения этапа раннего исследования.

Этот результат находится всего на 2,3 пункта выше Muse Spark 1.1, модели, выпущенной Meta в июле.

Модель Meta сняла свои графики кодирования

Meta сравнила себя с GPT-5.6 Terra. OpenAI продает более мощную модель под названием Sol, и Meta исключила ее из всех трех диаграмм программирования.

Sol возглавляет независимый рейтинг Terminal-Bench 2.1 leaderboard с результатом 89,5%. За ним следует Opus 5 с 89,1%.

Оба показателя превзошли 86,7%, сообщенные Meta для Opus 5. Meta выбрала более слабые настройки своего самого сильного конкурента, но всё равно осталась позади него.

Против Sol, настоящего лидера, Muse Spark 1.2 отстает на 6,6 пункта, а не на 3,8.

Meta всё же включила Sol в одном месте. При задаче на ядре графического процессора (GPU), выполнявшей более 1000 вызовов инструментов, Sol показала улучшение по сравнению с базовой линией на 71,2%. Muse Spark 1.2 показала 68,7% и заняла четвёртое место из шести.

Одно ограничение работает в другую сторону. Muse Spark 1.2 еще не появился в этом публичном рейтинге, где было протестировано только 26 из 183 отслеживаемых моделей. Его показатель 82,9% остается данными Meta.

«Muse Spark 1.2 — это наш следующий шаг на пути к передовым технологиям, поскольку впереди ожидаются более крупные и мощные модели», — сказал Цукерберг в посте.

Цукерберг может вскоре провести модель, превзойдя самого себя

Сообщается, что Meta ведет переговоры о аренде вычислительных мощностей для Anthropic. Сделка может достигнуть $10 млрд за два года. Центры обработки данных Meta будут помогать запускать модели Claude, которые Muse Code был создан, чтобы вытеснить.

Лидерство за Muse Code было дорогостоящим. Цукерберг заплатил 14,3 млрд долларов в июне 2025 года за Scale AI и его основателя Александра Ванга, который теперь возглавляет Meta Superintelligence Labs.

Цена — это единственный рычаг, который остался у Ванга. Тарифы соответствуют запуску в июле первой платной API-платформы Meta по цене 1,25 доллара за миллион входящих токенов и 4,25 доллара за миллион исходящих токенов.

Уровень участника стоит более чем в 10 раз меньше. Разработчики получают квалификацию, позволяя Meta обучаться на их работе. Ван отказался назвать цифры внедрения линейки Muse Spark.

Аккаунты Meta объясняют скидку. Выручка выросла на 28% до 60,8 млрд долларов в прошлом квартале, однако операционная прибыль снизилась на 8% до 18,8 млрд долларов.

Операционная маржа снизилась до 31% по сравнению с 43% годом ранее. Meta потратила только за квартал $31,08 млрд на капитальные проекты и прогнозирует расходы до $145 млрд за год.

Muse Code предлагает инженерные возможности, которых не хватает у Claude Code. Фоновые агенты сохраняют контекст в течение сессии. Подагенты работают в изолированных копиях репозитория.

Meta создала надежного второго по силе кодера и оценила его как бюджетный вариант. Бета-версия покажет, готовы ли разработчики пожертвовать несколькими процентами точности ради счета, примерно в десять раз меньше.

Отказ от ответственности: Информация на этой странице может быть получена от третьих лиц и не обязательно отражает взгляды или мнения KuCoin. Данный контент предоставляется исключительно в общих информационных целях, без каких-либо заверений или гарантий, а также не может быть истолкован как финансовый или инвестиционный совет. KuCoin не несет ответственности за ошибки или упущения, а также за любые результаты, полученные в результате использования этой информации. Инвестиции в цифровые активы могут быть рискованными. Пожалуйста, тщательно оценивайте риски, связанные с продуктом, и свою устойчивость к риску, исходя из собственных финансовых обстоятельств. Для получения более подробной информации, пожалуйста, ознакомьтесь с нашими Условиями использования и Уведомлением о риске.