Atualizações de modelos de IA

OpenAI lança GPT-5.6 Sol, Terra e Luna com novos preços de API

A OpenAI lançou GPT-5.6 Sol, Terra e Luna no ChatGPT, Codex e na API, adicionando programação mais forte, fluxos multiagente, uso de ferramentas e três faixas de preço.

Publicado Atualizado
OpenAIGPT-5.6Modelos de IA

O maior lançamento de modelo de IA que chega em 10 de julho de 2026 é o lançamento geral do GPT-5.6 pela OpenAI. A família fica disponível no ChatGPT, no Codex e na API da OpenAI depois de uma prévia limitada, oferecendo aos usuários três níveis de capacidade e preço em vez de uma única opção principal.

A mudança importante não é apenas uma pontuação maior em benchmarks. A OpenAI posiciona o GPT-5.6 para o trabalho de ponta a ponta: programação, design, pesquisa, uso de computador, coordenação de ferramentas e documentos profissionais. Para usuários e desenvolvedores, a pergunta prática é qual nível conclui um fluxo de trabalho com a melhor combinação de qualidade, velocidade e custo total.

O que a OpenAI lançou

O GPT-5.6 tem três modelos. O GPT-5.6 Sol é o principal para raciocínio difícil, programação, cibersegurança, ciência e trabalho profissional. O GPT-5.6 Terra é a opção equilibrada para tarefas cotidianas, enquanto o GPT-5.6 Luna é o nível mais rápido e acessível.

A OpenAI afirma que a família extrai mais trabalho útil de cada token do que o GPT-5.5. O Sol acrescenta uso de computador e julgamento de design mais fortes, enquanto Terra e Luna buscam levar desempenho agêntico a cargas de trabalho que não precisam do modelo mais caro.

O lançamento também introduz modos de maior esforço para tarefas complexas. A configuração max dá ao modelo mais tempo para explorar e verificar uma resposta. A configuração ultra coordena vários agentes em frentes de trabalho paralelas, trocando maior uso de tokens por resultados mais fortes e menor tempo de conclusão em tarefas exigentes.

Novos recursos para desenvolvedores

O Programmatic Tool Calling permite que o GPT-5.6 escreva e execute programas leves que coordenam ferramentas, filtram resultados intermediários e decidem quais informações devem retornar ao modelo. Isso pode reduzir as idas e vindas repetidas ao modelo quando um agente precisa inspecionar muitos registros, saídas de ferramentas ou arquivos.

A Responses API também adiciona uma versão beta multiagente. Os desenvolvedores podem executar subagentes simultâneos e combinar seus resultados em uma única solicitação. Isso torna o lançamento relevante para agentes de programação, sistemas de pesquisa, análise financeira, fluxos de documentos e outros trabalhos que podem ser divididos em frentes independentes.

Preços e disponibilidade do GPT-5.6

No lançamento, o GPT-5.6 Sol custa US$ 5 de entrada e US$ 30 de saída por 1 milhão de tokens. O Terra custa US$ 2,50 de entrada e US$ 15 de saída, enquanto o Luna custa US$ 1 de entrada e US$ 6 de saída por 1 milhão de tokens.

O GPT-5.6 está sendo disponibilizado no ChatGPT, Codex e API da OpenAI. O acesso varia por plano: usuários pagos do ChatGPT recebem acesso ao Sol, enquanto ChatGPT Work e Codex expõem combinações diferentes de Sol, Terra, Luna, max e ultra conforme o nível da assinatura.

Para desenvolvedores, o preço de token anunciado é apenas o ponto de partida. Um modelo que usa menos chamadas de ferramentas, produz menos ciclos de correção ou conclui uma tarefa com menos tokens de saída pode ser mais barato mesmo quando sua tarifa listada é maior.

O que os usuários devem testar

  • Compare Sol, Terra e Luna na mesma tarefa real, em vez de depender apenas de benchmarks de modelos.
  • Meça em conjunto a qualidade de conclusão, latência, tokens de saída, chamadas de ferramentas e tempo de revisão.
  • Use Sol para programação difícil, pesquisa, design ou rascunhos profissionais de alto risco.
  • Direcione resumos de rotina, extração, classificação e edições simples para Terra ou Luna quando a qualidade continuar aceitável.
  • Trate ultra como um modo direcionado para trabalhos que se beneficiam de investigação paralela, não como padrão para todo prompt.

O que os criadores devem observar

Os criadores devem observar como o Programmatic Tool Calling muda a arquitetura de agentes. Se um modelo consegue processar a saída das ferramentas dentro de um programa leve, as aplicações podem precisar de menos ciclos de orquestração e menos duplicação de contexto. As equipes ainda devem manter avaliações, limites de custo, fronteiras de permissão e revisão humana em torno de ações consequentes.

O cache de prompts também importa. Leituras de cache mantêm um grande desconto, enquanto gravações de cache para o GPT-5.6 e modelos posteriores têm um adicional de preço. Produtos com prompts de sistema longos ou contexto repetido devem testar o comportamento do cache antes de estimar custos de produção.

Análise da intenção de busca

Quem busca notícias sobre o lançamento do GPT-5.6 normalmente quer saber quando o modelo foi lançado, como Sol, Terra e Luna diferem, se o GPT-5.6 está disponível no ChatGPT ou Codex e quanto custa a API.

Quem compara GPT-5.6 com Claude ou Gemini faz uma pergunta de fluxo de trabalho: qual modelo conclui tarefas de programação, pesquisa, design e agentes com menos correções e melhor desempenho por dólar? A resposta certa depende de avaliações representativas, e não de um único benchmark.

Perspectiva da Goodiebase

O GPT-5.6 torna a seleção de modelos mais explícita. Sol, Terra e Luna não são simplesmente bom, melhor e ótimo; são escolhas de roteamento para orçamentos e cargas de trabalho diferentes.

Para usuários da Goodiebase, a conclusão prática é atualizar por tarefa. Teste o nível mais forte em trabalhos em que qualidade e autonomia economizam tempo significativo de revisão e, em seguida, use modelos de menor custo para tarefas repetíveis que não se beneficiam do raciocínio máximo.