Kode Muse Meta Kalah dari Claude Opus 5 Anthropic dalam Uji Coba Pemrograman AI

iconBeInCrypto
Bagikan
AI summary iconRingkasan
Berita AI + kripto: Meta’s Muse Code, diluncurkan dalam versi beta pada 5 Agustus 2026, kalah dari Claude Opus 5 milik Anthropic di semua empat benchmark pemrograman yang diterbitkan Meta. Data independen menunjukkan kesenjangan yang lebih besar daripada yang dilaporkan. Meta menghilangkan GPT-5.6 Sol milik OpenAI, yang memimpin dalam pengujian. Data inflasi tetap menjadi faktor makro utama bagi pasar kripto.

Mark Zuckerberg meluncurkan Muse Code dalam versi beta pada Rabu, agen pemrograman kecerdasan buatan (AI) pertama Meta. Claude Opus 5 dari Anthropic mengunggulinya dalam keempat perbandingan yang dipublikasikan Meta saat peluncuran.

Meta merilis grafik-grafik itu tetap. Perusahaan menjual alat yang lebih murah, bukan yang lebih baik. Data uji independen menunjukkan bahwa kesenjangan tersebut lebih lebar daripada yang ditunjukkan Meta.

Disponsori
Disponsori

Ikuti kami di X untuk mendapatkan berita terbaru saat terjadi

Grafik Milik Meta Mengalahkan Anthropic di Setiap Putaran

Muse Spark 1.2 adalah model di dalam Muse Code. Model ini mendapat skor 82,9% pada Terminal-Bench 2.1.

Claude Opus 5 mendapatkan skor 86,7% pada tes yang sama. Terminal-Bench berasal dari Institut Laude dan peneliti Stanford. Tes ini mencakup 89 pekerjaan nyata yang mencakup perbaikan sistem, pekerjaan data, dan keamanan.

Peringkat kedua patut diacungi jempol. Muse Code mengalahkan Codex milik OpenAI dengan 81,8% dan Grok Build dengan 81,6%.

Grafik perbandingan benchmark untuk Muse Spark 1.2
Grafik perbandingan benchmark untuk Muse Spark 1.2, Sumber: Zuckerberg

Grafik berikutnya lebih berat. DeepSWE 1.1 menetapkan 113 tugas pemrograman dengan akses internet dimatikan selama penilaian. Muse Spark 1.2 turun ke posisi ketiga dengan 59,3%.

Meta kemudian menerbitkan tes yang dibuat sendiri, diambil dari 440 pull request nyata oleh insinyur mereka. Muse Spark 1.2 mendapat skor 70,6% di sana, kira-kira sembilan poin di belakang Opus 5.

Disponsori
Disponsori
Muse Spark 1.2 menjalankan tugas optimasi kernel selama 24 jam di NVIDIA Hopper — lebih dari 1.000 panggilan alat — dan terus menemukan peningkatan kecepatan nyata jauh setelah fase eksplorasi awal.
Muse Spark 1.2 menjalankan tugas optimasi kernel selama 24 jam di NVIDIA Hopper — lebih dari 1.000 panggilan alat — dan terus menemukan peningkatan kecepatan nyata jauh setelah fase eksplorasi awal.

Skor tersebut hanya berada 2,3 poin di atas Muse Spark 1.1, model yang dirilis Meta pada Juli.

Model Meta Menghilangkan Diagram Kodingnya

Meta mengukur dirinya sendiri terhadap GPT-5.6 Terra. OpenAI menjual model yang lebih kuat bernama Sol, dan Meta tidak memasukkannya ke dalam ketiga grafik pemrograman tersebut.

Sol memimpin peringkat independen Terminal-Bench 2.1 leaderboard di 89,5%. Opus 5 menyusul di 89,1%.

Kedua angka tersebut mengalahkan 86,7% yang dilaporkan Meta untuk Opus 5. Meta memilih pengaturan yang lebih lemah dari pesaing terkuatnya dan tetap ketinggalan.

Melawan Sol, pemimpin sejati, Muse Spark 1.2 tertinggal 6,6 poin daripada 3,8.

Meta memang menyertakan Sol di satu tempat. Pada tugas kernel unit pemroses grafis (GPU) yang berjalan melebihi 1.000 panggilan alat, Sol meningkatkan baseline sebesar 71,2%. Muse Spark 1.2 mencapai 68,7% dan menempati peringkat keempat dari enam.

Satu peringatan membalikkan arahnya. Muse Spark 1.2 belum muncul di daftar peringkat publik tersebut, di mana hanya 26 dari 183 model yang dilacak yang telah diuji. Angka 82,9% tetap merupakan angka dari Meta.

“Muse Spark 1.2 adalah langkah berikutnya kami dalam mendorong menuju frontier, dengan model yang lebih besar dan lebih mampu akan segera datang,” kata Zuckerberg said dalam sebuah posting.

Zuckerberg Mungkin Segera Menjadi Tuan Rumah Model yang Mengalahkan Dirinya Sendiri

Meta dilaporkan sedang berunding untuk menyewa komputasi ke Anthropic. Kesepakatan ini bisa mencapai $10 miliar dalam dua tahun. Pusat data Meta kemudian akan membantu menjalankan model Claude yang dirancang untuk menggantikan Muse Code.

Kepemimpinan di balik Muse Code mahal. Zuckerberg membayar $14,3 miliar pada Juni 2025 untuk Scale AI dan pendirinya Alexandr Wang, yang kini memimpin Meta Superintelligence Labs.

Harga adalah tuas yang tersisa bagi Wang. Tarif sesuai dengan peluncuran Juli API pertama berbayar Meta sebesar $1,25 per juta token masukan dan $4,25 per juta token keluaran.

Tingkat kontributor biayanya lebih dari 10 kali lebih murah. Pengembang memenuhi syarat dengan membiarkan Meta melatih dirinya pada karya mereka. Wang menolak memberikan angka adopsi untuk lini Muse Spark.

Akun Meta menjelaskan diskonnya. Pendapatan naik 28% menjadi $60,8 miliar pada kuartal lalu, namun laba operasional turun 8% menjadi $18,8 miliar.

Margin operasi turun menjadi 31% dari 43% pada periode yang sama tahun sebelumnya. Meta menghabiskan $31,08 miliar untuk proyek modal hanya dalam kuartal ini, dan memperkirakan hingga $145 miliar untuk tahun ini.

Muse Code menawarkan teknik yang tidak dimiliki Claude Code. Agen latar belakang mempertahankan konteks sepanjang sesi. Sub-agen bekerja dalam salinan terpisah dari repositori.

Meta telah membangun pengkode terbaik kedua yang solid dan menetapkan harganya seperti opsi anggaran. Versi beta akan menunjukkan apakah pengembang mengorbankan beberapa poin akurasi demi tagihan yang sekitar sepuluh kali lebih kecil.

Penafian: Informasi pada halaman ini mungkin telah diperoleh dari pihak ketiga dan tidak mencerminkan pandangan atau opini KuCoin. Konten ini disediakan hanya untuk tujuan informasi umum, tanpa representasi atau jaminan apa pun, dan tidak dapat ditafsirkan sebagai saran keuangan atau investasi. KuCoin tidak bertanggung jawab terhadap segala kesalahan atau kelalaian, atau hasil apa pun yang keluar dari penggunaan informasi ini. Berinvestasi di aset digital dapat berisiko. Harap mengevaluasi risiko produk dan toleransi risiko Anda secara cermat berdasarkan situasi keuangan Anda sendiri. Untuk informasi lebih lanjut, silakan lihat Ketentuan Penggunaan dan Pengungkapan Risiko.