OpenAI anuncia GPT-5.6 para reduzir custo de uso de IA
Nova família combina modelos mais baratos com ajustes em inferência e agentes, segundo a empresa
Nova família combina modelos mais baratos com ajustes em inferência e agentes, segundo a empresa
A OpenAI anunciou a família GPT-5.6 em 2026-07-29 para entregar mais capacidade por dólar em tarefas de inteligência artificial. O modelo GPT-5.6 Sol, segundo a empresa, supera Claude Fable 5 no Artificial Analysis Coding Agent Index com menos da metade do custo. A linha também inclui Terra, que iguala GPT-5.5 em benchmarks de inteligência pela metade do preço, e Luna, que custa 80% menos que Sol. A mudança interessa a empresas e desenvolvedores que usam modelos em Codex, ChatGPT Work e outros fluxos com agentes.
A OpenAI diz que treinou GPT-5.6 para fazer mais trabalho com cada token. No treinamento, a empresa otimiza tanto o sucesso da tarefa quanto a eficiência, para levar o modelo por um caminho mais direto. Esse ajuste reduz o trabalho necessário para chegar ao resultado.
O comunicado também descreve mudanças fora do modelo. A equipe alterou balanceamento de carga, decodificação especulativa, cache e kernels para gerar mais saída com o mesmo hardware. A empresa afirma que essas melhorias preservam inteligência, latência, disponibilidade e confiabilidade durante a inferência.
O balanceamento distribui pedidos conforme geografia, capacidade disponível e tipo de acelerador. Dentro de cada cluster, o sistema considera carga, tamanho do contexto e disponibilidade de cache. A OpenAI diz que GPT-5.6 Sol, dentro do Codex, analisa tráfego de produção, encontra desequilíbrios e testa novas regras de roteamento.
A empresa também usou Sol para ajustar o forward pass, etapa que transforma entradas em previsões do próximo token. O modelo encontrou operações que poderiam ser pré-computadas, eliminadas ou executadas em paralelo. Segundo a OpenAI, o trabalho reduziu movimentação de memória, sincronização e períodos de ociosidade das GPUs.
A segunda frente envolve o chamado agentic harness, camada que organiza o uso de modelos por agentes. A OpenAI diz que melhorou o controle do excesso de contexto, do uso de ferramentas e do trabalho repetido. Codex e ChatGPT Work usam essa camada.
GPT-5.6 Sol também teria reescrito e otimizado autonomamente kernels de produção por meio do Codex. A OpenAI atribui parte do resultado ao treinamento do modelo para escrever e melhorar kernels em Triton e Gluon, linguagens abertas de programação para GPUs mantidas pela própria empresa. A companhia não apresenta, no trecho divulgado, números separados para cada otimização.
A OpenAI enquadra essas mudanças no crescimento de seus serviços. A empresa afirma que ampliou os modelos para 1 bilhão de usuários ativos e mais de 2 milhões de empresas nos últimos quatro anos. Para ela, reduzir o custo de inferência ajuda a distribuir esses modelos em maior escala.
O anúncio traz comparações de custo e desempenho, mas não detalha os resultados dos benchmarks nem informa a metodologia usada. Também não apresenta validação independente além da referência ao Artificial Analysis Coding Agent Index. O texto não informa disponibilidade, requisito de acesso ou hardware necessário para usar GPT-5.6, nem lista uma limitação técnica específica para os modelos.