
GPT-5.6 Luna fica 80% mais barato e ganha modo Fast
Redução de preços
A OpenAI anunciou em 30 de julho de 2026 uma redução significativa nos preços da família GPT-5.6. O modelo Luna, o mais rápido e acessível da linha, teve corte de 80% no custo. O Terra, modelo equilibrado para trabalho cotidiano, ficou 20% mais barato. Os novos preços na API são: Luna a $0,20 por milhão de tokens de entrada e $1,20 por milhão de tokens de saída; Terra a $2 por milhão de tokens de entrada e $12 por milhão de tokens de saída. O preço do Sol permanece inalterado.
Modo Fast
A OpenAI introduziu o Fast mode na API, substituindo o antigo Priority Processing. Para o GPT-5.6 Sol, o Fast mode entrega velocidades até 2,5× maiores que o processamento padrão, pelo dobro do preço, sem alteração na qualidade do modelo. Requisições já marcadas como "priority" migram automaticamente para o Fast mode, garantindo compatibilidade retroativa.
Como a eficiência foi alcançada
Segundo a OpenAI, os ganhos vêm de melhorias em três camadas: os próprios modelos (que seguem caminhos mais diretos na resolução de tarefas), os sistemas de inferência (com roteamento e geração de tokens mais eficientes) e o harness agêntico (com gerenciamento de contexto mais inteligente, evitando repetição de trabalho já concluído). O GPT-5.6 Sol foi usado internamente para reescrever e otimizar kernels de produção, reduzindo o custo de serving em 20% e aumentando a eficiência de geração de tokens em mais de 15%.
Desempenho e casos de uso
A OpenAI afirma que o Luna entrega performance comparável a modelos de fronteira de um ano atrás a aproximadamente 6 centavos por tarefa e quase nove vezes mais rápido. No benchmark Agents' Last Exam, o Luna supera o Fable 5 com custo estimado por tarefa quase 99% menor.
Empresas parceiras relatam resultados concretos:
- Replit: o presidente Michele Catasta descreveu o Luna como "o mais próximo de inteligência barata demais para medir", desbloqueando casos de uso inesperados.
- Notion: Hoda Noorian relatou que o Terra entregou qualidade comparável ao GPT-5.5 pela metade do custo e 60% menos tempo.
- Blitzy: o CTO Sid Pardeshi afirmou que o Luna permitiu migrar de uma chamada estruturada única para um loop agêntico completo, aumentando o reúso de prompt-cache de 24% para 90% e reduzindo custos em 87% em relação ao GPT-5.4 mini.
- Cognition: Walden Yan disse que o Luna foi incorporado ao Devin Fusion como "par programador" para modelos maiores, gerando economia sem comprometer qualidade.
- Dust: Stanislas Polu relatou que o Luna é 40% mais rápido e 40% mais barato que o modelo padrão anterior.
Disponibilidade
Os novos preços valem a partir de 30 de julho na API, no ChatGPT Work e no Codex. No ChatGPT Work e no Codex, usuários Free e Go acessam o Terra; usuários Plus, Pro, Business e Enterprise podem escolher entre Terra e Luna. Os preços de assinatura não mudam, mas o consumo de créditos por uso de Terra e Luna diminui. A atualização na AWS começa a ser implementada no mesmo dia.