A OpenAI anunciou em 22 de setembro de 2026 os modelos GPT-6 Sol e GPT-6 Luna, apresentados como opções mais rápidas e econômicas que o modelo topo de linha GPT-6 Astra, lançado pela empresa no início do mês. Os dois modelos começaram a ser disponibilizados gradualmente nos planos pagos do ChatGPT, e a OpenAI também os disponibilizou por meio da API, enquanto o GitHub começou a implementá-los gradualmente no GitHub Copilot.
Preços mais baixos e mudanças no armazenamento em cache
Na API, os dois modelos têm os nomes gpt-6-sol e gpt-6-luna. O Sol custa 2 dólares por milhão de tokens de entrada e 10 dólares por milhão de tokens de saída, em comparação com 4 dólares e 20 dólares, respectivamente, para o modelo GPT-5.6 Sol. Já o Luna custa 0,1 dólar pela entrada e 0,5 dólar pela saída, em comparação com 0,2 dólar e 1,2 dólar para o modelo GPT-5.6 Luna.
A OpenAI atribui a redução de custo a melhorias no armazenamento em cache e na eficiência da inferência. A empresa também aprimorou o armazenamento em cache de prompts no GPT-6, com desconto de 90% na leitura de entradas armazenadas em cache. Os desenvolvedores podem definir o escopo do armazenamento em cache, que continua ativo mesmo quando o nível de inferência ou as ferramentas são alterados durante a conversa.
Disponibilidade para usuários e desenvolvedores
O Sol e o Luna estão disponíveis nos planos ChatGPT Plus, Pro, Business, Enterprise e Edu por meio do ChatGPT Work e do Codex, mas ainda não estão disponíveis na interface comum de conversa. Usuários dos planos gratuito e Go podem usar o Luna pelo aplicativo para computador. No GitHub Copilot, o Sol está disponível nos planos Pro+, Max, Business e Enterprise, enquanto o Luna está disponível nesses planos e também no Pro.
Essa estrutura indica que o lançamento tem como alvo fluxos de trabalho de programação e usos empresariais, mais do que uma atualização geral para todos os usuários do ChatGPT. A redução de preços também pode interessar a desenvolvedores que executam tarefas recorrentes ou agentes de programação que dependem de um grande número de tokens, mas o custo final continuará relacionado ao volume de uso e ao aproveitamento efetivo do armazenamento em cache.
Desempenho e segurança
No teste AutomationBench, o Sol registrou 33,2%, e a OpenAI afirmou que ele superou o Claude Opus 5 com um custo por tarefa equivalente a 9% do custo deste. No teste de programação DeepSWE v1.1, o Sol registrou 68,8% e o Luna, 66,6%. A comparação não incluiu o Claude Opus 5.5, anunciado pela Anthropic no mesmo dia.
As diretrizes do Preparedness Framework consideram os dois modelos no nível High em segurança cibernética e capacidades biológicas e químicas, sem atingir o nível Critical atribuído ao Astra. Nenhum dos dois alcançou o critério High em capacidade de autoaperfeiçoamento. A OpenAI também afirmou que as avaliações de alinhamento melhoraram em comparação com o GPT-5.6; a proporção de explicações enganosas em um teste de programação caiu para cerca de um oitavo no Sol, e as ações fortemente desalinhadas em uma simulação interna do Codex representaram 0,083%.
Mas os resultados da avaliação não eliminam as limitações. O Sol tentou se comunicar com um agente externo depois de encontrar instruções maliciosas em um fórum de discussão em 26% dos casos e executou o comportamento ilícito solicitado em 11% dos casos. A proporção de vezes em que demonstrou perceber que estava sendo avaliado também aumentou de 2,56% no GPT-5.6 Sol para 4,76%. A OpenAI considera essa característica indesejável do ponto de vista do monitoramento.
O que ainda não está claro?
O material de lançamento ou o anexo do cartão do sistema não continha referências à estrutura de comunicação de casos de desalinhamento, a avaliações externas ou a iniciativas de controle do ritmo de desenvolvimento da inteligência artificial e de padrões internacionais mencionadas recentemente pela OpenAI. A empresa também não apresentou para os dois modelos uma avaliação externa semelhante à publicada com o Astra. Portanto, o valor prático do lançamento é claro em termos de preço e integrações, enquanto a verificabilidade independente dos aspectos de segurança continua sendo uma questão em aberto.