A Arena.ai acabou de alterar isso. A plataforma de avaliação votada pela comunidade introduziu categorias detalhadas de prompts para avaliar modelos de edição de imagens, dividindo o desempenho em sete dimensões principais. E os resultados iniciais são bem decisivos: o GPT Image 2 da OpenAI lidera em todas elas.
Os números por trás da dominância
O GPT Image 2 ocupa atualmente o topo do ranking de edição de imagens do Arena.ai com uma pontuação Elo de 1463, mais ou menos 4 pontos. Essa classificação é baseada em mais de 165.000 votos da comunidade.
O modelo, lançado em abril de 2026, não apenas superou a concorrência. Em algumas categorias, possui uma vantagem de 242 pontos Elo. Para contextualizar, nas classificações Elo de xadrez, uma diferença de 200 pontos geralmente significa que o jogador com pontuação mais alta vence cerca de 75% das vezes.
As sete novas categorias juntam-se às métricas de avaliação adicionais rastreadas pela Arena.ai, incluindo aderência ao prompt, estética e fotorealismo.
Quem mais está na corrida
Atrás da GPT Image 2, a imagem Muse da Meta ocupa a segunda posição, com a MAI-Image-2.5 da Microsoft completando os três primeiros. As variantes do Gemini do Google e os modelos Seedream da ByteDance também aparecem nas classificações.
A plataforma mais ampla acumulou 28,5 milhões de votos totais em 52 modelos no âmbito da edição de imagens.
A Arena.ai introduziu pela primeira vez categorias detalhadas de prompts para avaliações de texto para imagem em fevereiro de 2026, utilizando análise de agrupamento de prompts de usuários para identificar as maneiras mais significativas de segmentar os dados de desempenho. A expansão para edição de imagens segue a mesma metodologia.
O que isso significa para o mercado de IA
A abrangência da OpenAI em todas as sete categorias reforça sua posição no topo da hierarquia de IA generativa. A empresa agora alcançou o primeiro lugar nas tarefas de texto para imagem e edição de imagem no Arena.ai.
