Velocidade como novo diferencial competitivo
A OpenAI apresentou nesta quarta-feira (13) um novo modo de rodar o GPT-5.6 Sol, seu modelo mais capaz, com velocidade até 14 vezes maior que o processamento padrão. Chamado de Ultrafast, o tier de serviço é movido por hardware da Cerebras e consegue gerar até 750 tokens por segundo de saída.
A estreia acontece primeiro pela API da OpenAI, com acesso ainda restrito a um grupo seleto de clientes. Empresas interessadas podem entrar em uma lista de espera informando o tipo de carga de trabalho, requisitos de latência e volume de uso esperado.
Onde a velocidade faz diferença
O GPT-5.6 Sol foi lançado em junho, ao lado dos modelos Terra (equilibrado) e Luna (focado em velocidade), e a família completa ficou amplamente disponível em julho — inclusive no ChatGPT, no Codex e na API. Agora, o modo Ultrafast mira fluxos de trabalho em que a latência importa tanto quanto a inteligência do modelo.
Entre os casos de uso citados pela OpenAI estão atendimento por voz, suporte ao cliente, comércio, agentes de desenvolvimento, pesquisa financeira e resposta a incidentes de segurança. A própria empresa afirma que seus desenvolvedores já usaram o modo para analisar logs e rastros durante incidentes e para comprimir ciclos de pesquisa que antes rodavam durante a noite inteira em múltiplas iterações dentro do expediente.
Um marco para a infraestrutura de inferência
O anúncio também é relevante pelo que revela sobre a infraestrutura por trás do modelo. A Cerebras é conhecida por seus chips wafer-scale — processadores do tamanho de uma pastilha de silício inteira, em vez de chips individuais — que priorizam justamente a latência de inferência. Colocar o GPT-5.6 Sol para rodar nessa arquitetura sinaliza uma disputa crescente entre fornecedores de hardware por cargas de IA de fronteira em produção.
O que isso significa para o público brasileiro
Para empresas brasileiras que operam agentes em atendimento, voz e análise financeira, a promessa de modelos de fronteira com resposta quase instantânea muda o cálculo de viabilidade: tarefas que exigiam respostas em segundos podiam, até agora, demandar modelos menores e menos capazes. Ainda assim, o acesso é limitado e os preços do tier Ultrafast não foram divulgados — um ponto a observar quando o serviço abrir para o público geral.
Descubra mais sobre noticiAI
Assine para receber nossas notícias mais recentes por e-mail.



