Inteligência artificial, sem ruído.
OpenAI2 min

OpenAI apresenta modo ‘Ultrafast’ do GPT-5.6 Sol: até 14x mais rápido com chips da Cerebras

Novo tier roda no hardware da Cerebras e atinge até 750 tokens por segundo, com acesso inicial via API e lista de espera.

OpenAI apresenta modo ‘Ultrafast’ do GPT-5.6 Sol: até 14x mais rápido com chips da Cerebras

Velocidade como novo diferencial competitivo

A OpenAI apresentou nesta quarta-feira (13) um novo modo de rodar o GPT-5.6 Sol, seu modelo mais capaz, com velocidade até 14 vezes maior que o processamento padrão. Chamado de Ultrafast, o tier de serviço é movido por hardware da Cerebras e consegue gerar até 750 tokens por segundo de saída.

A estreia acontece primeiro pela API da OpenAI, com acesso ainda restrito a um grupo seleto de clientes. Empresas interessadas podem entrar em uma lista de espera informando o tipo de carga de trabalho, requisitos de latência e volume de uso esperado.

Onde a velocidade faz diferença

O GPT-5.6 Sol foi lançado em junho, ao lado dos modelos Terra (equilibrado) e Luna (focado em velocidade), e a família completa ficou amplamente disponível em julho — inclusive no ChatGPT, no Codex e na API. Agora, o modo Ultrafast mira fluxos de trabalho em que a latência importa tanto quanto a inteligência do modelo.

Entre os casos de uso citados pela OpenAI estão atendimento por voz, suporte ao cliente, comércio, agentes de desenvolvimento, pesquisa financeira e resposta a incidentes de segurança. A própria empresa afirma que seus desenvolvedores já usaram o modo para analisar logs e rastros durante incidentes e para comprimir ciclos de pesquisa que antes rodavam durante a noite inteira em múltiplas iterações dentro do expediente.

Um marco para a infraestrutura de inferência

O anúncio também é relevante pelo que revela sobre a infraestrutura por trás do modelo. A Cerebras é conhecida por seus chips wafer-scale — processadores do tamanho de uma pastilha de silício inteira, em vez de chips individuais — que priorizam justamente a latência de inferência. Colocar o GPT-5.6 Sol para rodar nessa arquitetura sinaliza uma disputa crescente entre fornecedores de hardware por cargas de IA de fronteira em produção.

O que isso significa para o público brasileiro

Para empresas brasileiras que operam agentes em atendimento, voz e análise financeira, a promessa de modelos de fronteira com resposta quase instantânea muda o cálculo de viabilidade: tarefas que exigiam respostas em segundos podiam, até agora, demandar modelos menores e menos capazes. Ainda assim, o acesso é limitado e os preços do tier Ultrafast não foram divulgados — um ponto a observar quando o serviço abrir para o público geral.


Descubra mais sobre noticiAI

Assine para receber nossas notícias mais recentes por e-mail.

R
Sobre o autorRedação Noticiai

Equipe editorial dedicada a explicar inteligência artificial com clareza, independência e contexto.