OpenAI lanzó un nuevo modelo llamado Ultrafast, destacando una mayor velocidad de respuesta del modelo. La empresa afirma que este modo permite que GPT 5.6 Sol funcione a 14 veces la velocidad de procesamiento estándar, con una velocidad de salida máxima de hasta 750 tokens por segundo, y actualmente está disponible en versión preliminar para un pequeño grupo de clientes.
Esta actualización responde a la demanda empresarial de procesamiento de IA en tiempo real. OpenAI indica que anteriormente, para obtener respuestas más cercanas al tiempo real, generalmente se requería cambiar a modelos más pequeños o seleccionar sistemas optimizados para tareas específicas. La dirección de Ultrafast consiste en aumentar la cantidad de trabajo útil que se puede completar por unidad de tiempo, sin depender únicamente de modelos pequeños.
Aumento de la velocidad de salida
Según OpenAI, el punto fuerte de Ultrafast es comprimir significativamente el tiempo de espera de generación.
- La velocidad máxima de salida puede alcanzar hasta 750 tokens por segundo
- La velocidad de procesamiento es aproximadamente 14 veces mayor que en el modo estándar.
- La versión actual aún está en fase de previsualización
TechCrunch mencionó que competidores como Anthropic también habían lanzado previamente modos acelerados. Por ejemplo, el producto de Claude también ofrece un modo rápido, pero los indicadores de velocidad anunciados por OpenAI esta vez son más altos.
Para flujos de trabajo empresariales
OpenAI dirige las aplicaciones de Ultrafast a múltiples tareas empresariales, con énfasis en respuesta a eventos, atención al cliente y soporte, análisis de mercados financieros y comercio electrónico, entre otros. Estos escenarios suelen ser más sensibles a la latencia, ya que el tiempo de respuesta del modelo afecta directamente la eficiencia de la colaboración humana y el rendimiento de los procesos automatizados.
Desde la perspectiva de la definición del producto, Ultrafast no es un nuevo modelo independiente, sino un modo de ejecución de alta velocidad diseñado en torno a GPT 5.6 Sol. Para los clientes empresariales, esto significa mantener la potente capacidad del modelo mientras se intenta integrar directamente la IA en los procesos comerciales en tiempo real.
Respaldado por Cerebras
OpenAI indica que Ultrafast es respaldado por su colaboración con la empresa de chips Cerebras. Actualmente, las primeras invitaciones a la previsualización están disponibles solo para un pequeño grupo de clientes, y el acceso se ampliará gradualmente a medida que aumente la capacidad de cómputo.
Esto también muestra que la competencia entre modelos grandes está extendiéndose desde la comparación de parámetros y capacidades hacia la velocidad de respuesta, la eficiencia de despliegue y la coordinación de la infraestructura de cómputo subyacente. Para los productos de IA orientados al mercado empresarial, la velocidad se está convirtiendo en un indicador clave al mismo nivel que la calidad del modelo.
