A OpenAI lançou um novo modelo chamado Ultrafast, com foco em maior velocidade de resposta do modelo. A empresa afirma que este modo permite que o GPT 5.6 Sol opere a 14 vezes a velocidade de processamento padrão, com uma taxa de saída máxima de até 750 tokens por segundo, e atualmente está disponível em pré-visualização para um pequeno número de clientes.
Esta atualização visa atender à demanda das empresas por processamento de IA em tempo real. A OpenAI afirmou que, anteriormente, para obter respostas mais próximas do tempo real, era geralmente necessário alternar para modelos menores ou escolher sistemas otimizados para tarefas específicas. A abordagem do Ultrafast é aumentar a quantidade de trabalho útil concluído por unidade de tempo, sem depender exclusivamente de modelos menores.
Aumento da velocidade de saída
De acordo com a OpenAI, o principal recurso do Ultrafast é a redução significativa do tempo de espera de geração.
- Velocidade máxima de saída de até 750 tokens por segundo
- A velocidade de processamento é aproximadamente 14 vezes maior que o modo padrão
- A versão atual ainda está em fase de pré-visualização
A TechCrunch mencionou que concorrentes como a Anthropic também lançaram anteriormente modos acelerados. Por exemplo, o produto Claude oferece um modo rápido, mas os indicadores de velocidade divulgados pela OpenAI desta vez são mais altos.
Para fluxos de trabalho empresariais
A OpenAI direciona os cenários de aplicação do Ultrafast para diversos tipos de tarefas empresariais, com foco principal em resposta a eventos, atendimento e suporte ao cliente, análise de mercados financeiros e comércio eletrônico. Esses cenários geralmente são mais sensíveis à latência, e o tempo de resposta do modelo afeta diretamente a eficiência da colaboração humana e o desempenho dos processos automatizados.
Do ponto de vista da posição do produto, o Ultrafast não é um novo modelo independente, mas sim uma forma de execução de alta velocidade em torno do GPT 5.6 Sol. Para clientes corporativos, isso significa manter a forte capacidade do modelo enquanto tenta integrar diretamente a IA nos processos de negócios em tempo real.
Com suporte da Cerebras
A OpenAI afirmou que o Ultrafast é suportado por sua parceria com a empresa de chips Cerebras. Os primeiros convites para prévia estão atualmente disponíveis apenas para um pequeno grupo de clientes e serão ampliados gradualmente à medida que a capacidade de computação aumentar.
Isso também demonstra que a competição entre grandes modelos está se expandindo da comparação de parâmetros e capacidades para a velocidade de resposta, eficiência de implantação e coordenação de infraestrutura de computação subjacente. Para produtos de IA voltados ao mercado corporativo, a velocidade está se tornando um indicador-chave ao lado da qualidade do modelo.
