OpenAI corta preço do GPT-5.6 Luna em 80% na API
A empresa também reduz o custo do Terra em 20% e acelera o Sol.
A empresa também reduz o custo do Terra em 20% e acelera o Sol.
A OpenAI anunciou em 2026-07-30 cortes de preço para os modelos GPT-5.6 Luna e Terra e um modo mais rápido para o Sol na API. O Luna passa a custar 80% menos, enquanto o Terra fica 20% mais barato. A mudança atende empresas que usam IA em tarefas de alto volume e fluxos com várias etapas. A mudança começa hoje.
Os preços menores também alteram a forma como o uso entra nas assinaturas pagas do Codex e do ChatGPT Work. A OpenAI descreve o Luna como seu modelo mais rápido e acessível para trabalho em escala. Ele usa ferramentas, executa fluxos com várias etapas e permite automatizar tarefas que antes custavam mais para rodar. O comunicado não informa um requisito adicional de acesso além desses produtos e da API.
O Luna busca equilibrar volume, velocidade e qualidade. A OpenAI afirma que seu desempenho se compara ao de modelos de fronteira de um ano atrás, com cerca de 6 centavos do custo por tarefa e velocidade quase nove vezes maior. A empresa não apresenta, no anúncio, uma validação externa desses números. Eles vêm da própria OpenAI.
Em trabalho profissional, a empresa diz que o Luna superou o Fable 5 no teste Agents’ Last Exam. Segundo a OpenAI, o custo estimado por tarefa ficou quase 99% menor. O comunicado não informa a quantidade de tarefas, a configuração usada ou os resultados detalhados dessa comparação. O número, portanto, descreve uma medição apresentada pela fabricante.
A OpenAI também substituiu o Priority Processing pelo Fast mode na API. No GPT-5.6 Sol, esse modo entrega velocidade de até 2,5 vezes a do processamento Standard, pelo dobro do preço e sem mudança na inteligência do modelo. Pedidos marcados como priority passam automaticamente a usar o Fast mode. A empresa não libera, no texto, outros detalhes sobre limites de uso ou disponibilidade fora da API.
A escolha do modelo deve mudar conforme cada etapa do trabalho, segundo a própria OpenAI. Um fluxo de programação pode usar o Sol para resolver incertezas e montar o plano, enquanto o Luna implementa alterações já especificadas, escreve testes, executa esses testes e avalia os resultados. A lógica combina mais inteligência onde o erro custa caro com processamento mais barato nas tarefas repetitivas. O ganho depende da avaliação que cada empresa fizer do resultado.
A empresa relaciona os preços menores a mudanças no modelo, nos sistemas de inferência e no mecanismo que conecta agentes a ferramentas e contexto. Um roteamento melhor mantém o hardware ocupado, enquanto o software de produção gera tokens com mais eficiência. O gerenciamento de contexto também evita que os agentes repitam trabalho concluído. A OpenAI afirma que essas técnicas reduzem tempo, tokens e custo por resultado.
O GPT-5.6 Sol participou do trabalho interno de otimização, dentro de um processo conduzido por pessoas. Segundo a OpenAI, o modelo reescreveu e ajustou kernels de produção, criou e executou centenas de experimentos para melhorar a geração de tokens e monitorou o treinamento, intervindo quando encontrou problemas. Esse processo reduziu em 20% o custo total de servir o modelo, enquanto os experimentos elevaram em mais de 15% a eficiência da geração de tokens. O comunicado não mostra uma auditoria independente desses resultados.
A OpenAI enquadra os cortes em uma estratégia para atender à demanda por mais capacidade de IA e por computação mais produtiva. A empresa diz que monta uma carteira de infraestrutura e direciona cada carga aos sistemas mais adequados. O anúncio sustenta que essa combinação amplia as opções entre preço, velocidade, confiabilidade e inteligência. Não há, porém, informação sobre novos sistemas, regiões de operação ou modelos adicionais liberados nesta atualização.