OpenAI a lancé un nouveau modèle appelé Ultrafast, axé sur une vitesse de réponse accrue du modèle. L'entreprise affirme que ce mode permet à GPT 5.6 Sol de fonctionner à 14 fois la vitesse de traitement standard, avec une vitesse de sortie pouvant atteindre jusqu'à 750 tokens par seconde. Il est actuellement disponible en prévisualisation pour un petit nombre de clients.
Cette mise à jour cible la demande des entreprises en traitement AI en temps réel. OpenAI indique que par le passé, pour obtenir des réponses plus proches du temps réel, il fallait généralement passer à des modèles plus petits ou choisir des systèmes optimisés pour des tâches spécifiques. L'approche d'Ultrafast consiste à augmenter la quantité de travail utile réalisable par unité de temps sans dépendre uniquement de modèles réduits.
Augmentation de la vitesse de sortie
Selon OpenAI, le principal atout d'Ultrafast est une réduction significative du temps d'attente de génération.
- Vitesse de sortie maximale pouvant atteindre 750 tokens par seconde
- La vitesse de traitement est environ 14 fois supérieure à celle du mode standard.
- La version actuelle est toujours en phase de prévisualisation
TechCrunch souligne que des concurrents comme Anthropic avaient déjà lancé des modes accélérés. Par exemple, le produit Claude propose également un mode rapide, mais les indicateurs de vitesse annoncés par OpenAI cette fois-ci sont plus élevés.
Pour les flux de travail d'entreprise
OpenAI oriente les scénarios d'application d'Ultrafast vers diverses tâches d'entreprise, notamment la réponse aux événements, le service et le soutien client, l'analyse des marchés financiers et le commerce électronique. Ces scénarios sont généralement plus sensibles à la latence, et le temps de réponse du modèle influence directement l'efficacité de la collaboration humaine et les performances des processus automatisés.
Du point de vue de la position produit, Ultrafast n'est pas un nouveau modèle indépendant, mais une méthode de fonctionnement à haute vitesse autour de GPT 5.6 Sol. Pour les clients professionnels, cela signifie conserver les capacités robustes du modèle tout en intégrant directement l'IA dans les processus métier en temps réel.
Prise en charge par Cerebras
OpenAI indique que Ultrafast est soutenu par son partenariat avec l'entreprise de puces Cerebras. Les premiers accès en prévisualisation sont actuellement limités à un petit groupe de clients et s'étendront progressivement à mesure que la capacité de calcul augmentera.
Cela montre également que la concurrence entre les grands modèles s'étend désormais de la comparaison des paramètres et des capacités à la vitesse de réponse, à l'efficacité de déploiement et à la coordination des ressources de calcul sous-jacentes. Pour les produits d'IA destinés au marché professionnel, la vitesse devient un indicateur clé à égalité avec la qualité du modèle.
