Arena.ai вже змінила це. Платформа, що базується на голосуванні спільноти, ввела детальні категорії промптів для оцінки моделей редагування зображень, розбивши продуктивність за сімома основними вимірами. І ранні результати досить вирішливі: GPT Image 2 від OpenAI посідає перше місце у всіх них.
Числа за домінуванням
GPT Image 2 зараз на першому місці в рейтингу Image Edit на Arena.ai з ело-рахунком 1463 плюс-мінус 4 бали. Цей рейтинг базується на більш ніж 165 000 голосів спільноти.
Модель, яка була запущена в квітні 2026 року, не просто перевершила конкуренцію. У деяких категоріях вона має лідери у 242 очки Elo. Для порівняння: у шахах різниця в 200 очок Elo зазвичай означає, що гравець з вищим рейтингом виграв близько 75% партій.
Сім нових категорій приєднуються до додаткових метрик оцінки, які відстежує Arena.ai, зокрема дотримання запиту, естетика та фотореалізм.
Хто ще бере участь у гонці
За GPT Image 2 позицію на другому місці тримає Meta’s Muse Image, а на третьому місці — MAI-Image-2.5 від Microsoft. У рейтингу також з’являються варіанти Google’s Gemini та моделі ByteDance’s Seedream.
Загальна кількість голосів, зібраних на платформі, становить 28,5 мільйона по 52 моделях у сфері редагування зображень.
Arena.ai вперше представила детальні категорії запитів для оцінки текст-у-зображення у лютому 2026 року, використовуючи кластерний аналіз користувацьких запитів для визначення найбільш значущих способів розбиття даних про продуктивність. Розширення на редагування зображень використовує ту ж методологію.
Що це означає для ринку ШІ
Охоплення OpenAI всіх семи категорій підтверджує її позицію на вершині ієрархії генеративного ІІ. Компанія досягла першого місця як у завданнях перетворення тексту в зображення, так і у завданнях редагування зображень на Arena.ai.
