Modelos e LLMs

OpenAI acelera GPT-5.6 Sol em até 14 vezes com nova API

Camada Ultrafast usa hardware da Cerebras e chega a 750 tokens por segundo, mas ainda está em prévia restrita.

A OpenAI anunciou em 2026-08-13 a camada Ultrafast para rodar o GPT-5.6 Sol em até 14 vezes a velocidade do processamento Standard. O serviço chega primeiro à API e alcança até 750 tokens de saída por segundo, segundo a empresa. A proposta atende produtos e fluxos que precisam responder enquanto pessoas, sistemas e dados continuam mudando.

A Cerebras sustenta a velocidade da nova camada

A Cerebras fornece a infraestrutura de inferência de baixa latência para o Ultrafast. O modelo continua sendo o GPT-5.6 Sol, mas a OpenAI afirma que a combinação entrega uma velocidade que antes exigia escolher um modelo menor ou mais especializado. A mudança mira mais trabalho por segundo.

O ganho afeta tarefas que dependem de várias etapas. Em resposta a incidentes, o sistema pode ler logs, analisar mudanças recentes no código e sintetizar relatos de engenheiros durante uma falha. Em suporte, a empresa cita respostas complexas em tempo real, sem interromper a conversa nem depender de uma única consulta.

A OpenAI também aponta usos em pesquisa financeira, segurança, comércio e experimentos. O modelo pode analisar sinais de mercado, avaliar transações, identificar atividade suspeita, consultar estoque e lidar com problemas no checkout. Em pesquisa, a empresa diz que tarefas que levavam uma noite podem virar ciclos interativos durante o dia.

Esses casos ainda representam relatos da OpenAI, não um benchmark independente. O comunicado não apresenta uma comparação detalhada de latência, custo, taxa de erro ou desempenho entre Ultrafast e Standard. A cifra de 14 vezes e o limite de 750 tokens por segundo são números declarados pela própria empresa.

A prévia ainda não chegou a todos

A OpenAI testa o GPT-5.6 Sol no Ultrafast com um grupo inicial de empresas. Os testes cobrem programação, comércio, pesquisa financeira, atendimento e outras aplicações interativas em ambientes de produção. A companhia afirma que usa esse trabalho para descobrir onde a mudança de velocidade gera mais efeito e orientar a expansão da capacidade.

Dentro da própria OpenAI, desenvolvedores usam a camada em resposta a incidentes. Eles aplicam o modelo para ler logs, analisar traces, reunir conversas, indicar verificações e preparar ou validar correções. Os engenheiros continuam responsáveis pelo julgamento e pela implantação das mudanças.

A equipe de pesquisa da OpenAI usa o Ultrafast para buscar fontes, consultar dados e organizar informações em ferramentas conectadas. Segundo o anúncio, o fluxo antes envolvia iniciar experimentos à noite e revisar os resultados pela manhã. Com mais velocidade, a empresa tenta executar várias iterações durante o expediente.

O acesso permanece limitado ao período de prévia e ao grupo inicial de clientes. A OpenAI não anuncia liberação ampla na API. Empresas interessadas podem se cadastrar para receber aviso quando o acesso se expandir, mas o comunicado não informa uma data para isso.

A empresa também mostra GPT-5.6 Sol nas versões Ultrafast e Standard construindo, lado a lado, um simulador 3D de armazém a partir do mesmo prompt. A demonstração ilustra a diferença de tempo, mas não substitui métricas públicas sobre qualidade ou custo. O movimento descrito pela OpenAI é claro: manter a inteligência do modelo enquanto reduz o tempo de resposta.

Fontes

OpenAIModelos e LLMs
Como fazemos: nossa equipe monitora diariamente os repositórios de código aberto em maior alta e produz esta cobertura com apoio de modelos de linguagem, sempre a partir de dados verificados na fonte primária — repositório, documentação oficial e ranking público. Os números de estrelas e a posição no ranking refletem o momento da coleta. Entenda o método.