Arena.ai baru saja mengubahnya. Platform penilaian yang dipilih oleh komunitas telah memperkenalkan kategori prompt rinci untuk mengevaluasi model pengeditan gambar, memecah kinerja menjadi tujuh dimensi utama. Dan hasil awalnya cukup jelas: GPT Image 2 dari OpenAI memimpin di setiap aspeknya.
Angka-angka di balik dominansi
GPT Image 2 saat ini berada di puncak leaderboard Arena.ai Image Edit dengan skor Elo 1463, plus atau minus 4 poin. Peringkat ini didasarkan pada lebih dari 165.000 suara komunitas.
Model yang diluncurkan pada April 2026 tidak hanya mengungguli pesaingnya. Di beberapa kategori, model ini memegang keunggulan sebesar 242 poin Elo. Sebagai konteks, dalam peringkat Elo catur, selisih 200 poin biasanya berarti pemain dengan peringkat lebih tinggi menang sekitar 75% dari waktu.
Tujuh kategori baru bergabung dengan metrik evaluasi tambahan yang dilacak oleh Arena.ai, termasuk kepatuhan terhadap prompt, estetika, dan fotorealistis.
Siapa lagi yang ikut perlombaan
Di belakang GPT Image 2, Meta’s Muse Image menempati posisi kedua, dengan Microsoft’s MAI-Image-2.5 menyelesaikan tiga besar. Varian Gemini dari Google dan model Seedream dari ByteDance juga muncul dalam peringkat.
Platform yang lebih luas telah mengumpulkan 28,5 juta suara total secara keseluruhan di 52 model di bidang pengeditan gambar.
Arena.ai pertama kali memperkenalkan kategori prompt rinci untuk evaluasi teks-ke-gambar pada Februari 2026, menggunakan analisis clustering terhadap prompt pengguna untuk mengidentifikasi cara paling bermakna untuk membagi data kinerja. Ekspansi ke pengeditan gambar mengikuti metodologi yang sama.
Apa artinya ini bagi pasar AI
Penguasaan OpenAI di semua tujuh kategori memperkuat posisinya di puncak hierarki generatif AI. Perusahaan kini mencapai peringkat pertama dalam tugas teks-ke-gambar dan pengeditan gambar di Arena.ai.
