A família GPT-5.6 da OpenAI já está disponível de forma geral no Amazon Bedrock, trazendo os modelos mais inteligentes já lançados pela empresa para o motor de inferência de próxima geração da AWS. A novidade inclui três variantes — Sol, Terra e Luna — com preços equivalentes aos da OpenAI e consumo contabilizado nos compromissos AWS existentes.
Três modelos para três necessidades
A OpenAI introduz um novo sistema de nomenclatura com o GPT-5.6: o número identifica a geração, enquanto Sol, Terra e Luna identificam níveis de capacidade que podem evoluir em ritmos próprios.
GPT-5.6 Sol é o modelo de raciocínio principal, o mais poderoso da OpenAI até agora. Segundo a empresa, o Sol estabelece um novo estado da arte no Artificial Analysis Coding Agent Index com 80 pontos (2,8 acima do segundo colocado), usando menos da metade dos tokens de saída e custando cerca de um terço a menos. O modelo também alcança 73,5% no ExploitBench para pesquisa de cibersegurança (contra 47,9% do GPT-5.5) e 53,6 pontos no Agents’ Last Exam, superando o próximo melhor modelo em 13,1 pontos. O Sol também introduz esforço máximo de raciocínio, que permite alocar mais computação para tarefas complexas.
Use o Sol para agentes de codificação autônomos, pesquisa de vulnerabilidades, descoberta de medicamentos e tarefas que exigem raciocínio profundo em múltiplas etapas.
GPT-5.6 Terra é o modelo equilibrado para produção diária. Entrega desempenho superior ao GPT-5.5 com custo menor. Ideal para geração de código, fluxos de conteúdo, extração estruturada de dados e tarefas agentivas de uso geral que precisam de raciocínio forte sem o preço do modelo principal.
GPT-5.6 Luna é o modelo rápido e acessível. Projetado para tarefas de inferência de alto volume como classificação, sumarização, roteamento e aplicações em tempo real onde latência e custo por token são prioritários.
Motor de inferência de nova geração
O tráfego de agentes é frequentemente irregular: uma única requisição de usuário pode disparar centenas de chamadas ao modelo. O motor de inferência de próxima geração do Amazon Bedrock agrupa capacidade para absorver picos de demanda enquanto isola o throughput de cada cliente.
Uma inovação importante é o prompt caching com breakpoints explícitos: instruções de sistema, definições de ferramentas e arquivos de referência que se repetem entre chamadas podem ser marcados com um breakpoint de cache. O Bedrock reutiliza o contexto processado em requisições subsequentes que compartilham o mesmo prefixo, e a entrada em cache é cobrada com 90% de desconto, permanecendo disponível para reuso por pelo menos 30 minutos. Isso cobre o burst de chamadas que uma única execução de agente gera sem que o custo exploda conforme a escala.
Toda inferência é mantida dentro da região AWS especificada (in-Region), ajudando equipes a atender requisitos rigorosos de residência de dados.
Segurança reforçada
O GPT-5.6 incorpora a pilha de segurança mais robusta da OpenAI até agora, combinando red teaming humano com testes automatizados em larga escala. A pilha inclui recusas no nível do modelo para atividades proibidas, classificadores de uso indevido em tempo real, monitoramento contínuo e enforcement no nível da conta para padrões persistentes.
No Amazon Bedrock, essas proteções operam sobre segurança em nível de hardware. A AWS utiliza um modelo de zero-operator access (ZOA) aplicado no chip: nenhum operador da AWS pode acessar seus prompts ou respostas. Cada chamada ao modelo roda sob suas políticas IAM, dentro da sua VPC, e é registrada no AWS CloudTrail.
Disponibilidade e como começar
O GPT-5.6 Sol está disponível nas regiões US East (N. Virginia) e US East (Ohio). O Terra e o Luna estão disponíveis também em US West (Oregon). O acesso pode ser feito pelo Console do Amazon Bedrock ou programaticamente pela Responses API.
Junto com o GPT-5.6, a OpenAI também lançou o ChatGPT Work, um agente dentro do ChatGPT para tarefas maiores e em múltiplas etapas, e atualizou o app desktop com os agentes Work e Codex em uma experiência unificada.
Descubra mais sobre noticiAI
Assine para receber nossas notícias mais recentes por e-mail.



