Arena.ai acaba de cambiar eso. La plataforma de evaluación votada por la comunidad ha introducido categorías detalladas de prompts para evaluar modelos de edición de imágenes, desglosando el rendimiento en siete dimensiones principales. Y los resultados iniciales son bastante decisivos: GPT Image 2 de OpenAI lidera en todas y cada una.
Los números detrás de la dominancia
GPT Image 2 ocupa actualmente el primer lugar en el ranking de edición de imágenes de Arena.ai con una puntuación Elo de 1463, más o menos 4 puntos. Este ranking se basa en más de 165,000 votos de la comunidad.
El modelo, lanzado en abril de 2026, no solo superó a la competencia. En algunas categorías, mantiene una ventaja de 242 puntos Elo. Para contextualizar, en las clasificaciones Elo del ajedrez, una diferencia de 200 puntos generalmente significa que el jugador con mayor rating gana aproximadamente el 75% de las veces.
Las siete nuevas categorías se suman a las métricas de evaluación que Arena.ai rastrea, incluyendo adhesión al prompt, estética y realismo fotográfico.
¿Quién más está en la carrera?
Detrás de GPT Image 2, la imagen Muse de Meta ocupa la segunda posición, con MAI-Image-2.5 de Microsoft completando los tres primeros. Las variantes de Gemini de Google y los modelos Seedream de ByteDance también aparecen en los rankings.
La plataforma general ha acumulado 28,5 millones de votos en total en 52 modelos en el ámbito de la edición de imágenes.
Arena.ai presentó por primera vez categorías detalladas de prompts para evaluaciones de texto a imagen en febrero de 2026, utilizando análisis de agrupamiento de prompts de usuarios para identificar las formas más significativas de segmentar los datos de rendimiento. La expansión a la edición de imágenes sigue la misma metodología.
Qué significa esto para el mercado de IA
El dominio de OpenAI en las siete categorías refuerza su posición en la cima de la jerarquía de IA generativa. La empresa ha logrado ahora el primer lugar en tareas de texto a imagen y edición de imágenes en Arena.ai.
