OpenAI lança GPT-6 Sol e Luna com menos erros pela metade do preço
Os modelos já estão disponíveis no ChatGPT Work e no Codex para usuários dos planos Plus, Pro, Business, Enterprise e Edu. Nos planos Free e Go, o GPT-6 Luna pode ser usado pelo aplicativo para desktop . Para desenvolvedores, os modelos estão disponíveis pela API. A OpenAI afirma que a chegada ao ChatGPT será gradual ao longo do dia, mas os modelos ainda não estão disponíveis na interface padrão de “Chat”.
O GPT-6 Sol é voltado para tarefas profissionais complexas e programação e o Luna foi desenvolvido para trabalhos de alto volume, como resumos e extração de informações. A arquitetura dos dois modelos também foi otimizada para fluxos de trabalho longos e agentes de IA , com recursos que ajudam a reduzir o custo de operações que reutilizam grandes quantidades de contexto.
Um desses recursos é o cache de prompts . A leitura de tokens de entrada armazenados em cache recebe 90% de desconto, o que reduz o custo de aplicações que reaproveitam informações ao longo de diferentes etapas de uma tarefa. Na API, o GPT-6 Sol tem o preço reduzido de US$ 4 para US$ 2 por 1 milhão de tokens de entrada e de US$ 20 para US$ 10 na saída. Já o GPT-6 Luna cai de US$ 0,20 para US$ 0,10 na entrada e de US$ 1,20 para US$ 0,50 na saída.
Os dois modelos têm redução de 50% nos preços em relação aos valores promocionais da linha GPT-5.6. A combinação entre preços menores, cache barato e foco em tarefas de longa duração busca tornar o uso dos modelos mais viável para desenvolvedores que precisam processar grandes volumes de informações.
Os testes de desempenho apresentados pela OpenAI mostram resultados diferentes de acordo com a proposta de cada modelo. O GPT-6 Sol foi avaliado em tarefas profissionais, programação e engenharia de software, enquanto o Luna também apresentou resultados em automação, uso de computador, engenharia de software e confiabilidade factual.
No AutomationBench, que avalia fluxos de trabalho de negócios em diferentes aplicativos, o GPT-6 Sol superou o Claude Opus 5, da concorrência, com custo equivalente a apenas 9% do valor por tarefa . Na programação, o modelo igualou o desempenho do Claude Fable 5.1 no FrontierCode, que verifica se o código produzido está pronto para ser incorporado a bases de código reais. Já no DeepSWE v1.1, voltado para tarefas complexas de engenharia de software, o Sol alcançou 68,8% de pontuação , com custo 80% menor que o de modelos concorrentes de alto desempenho.
O GPT-6 Luna também apresentou evolução em relação à geração anterior. No AutomationBench, em nível de esforço alto, o modelo superou o GPT-5.6 Luna em 5,4 pontos percentuais , com custo por tarefa 58% menor . No DeepSWE v1.1, o Luna alcançou 66,6% de pontuação no nível máximo de esforço, resultado comparável ao de Claude Opus 5 e Claude Fable 5 em níveis médios de esforço.
No OSWorld 2.0 offline, que avalia tarefas de uso de computador, o Luna também superou o GPT-5.6 Sol, considerando esforço médio para o modelo anterior, com apenas um décimo do preço . A OpenAI ainda avaliou a confiabilidade factual dos modelos.
Resumo agregado pelo 5News a partir do feed público do veículo. A matéria completa, com todo o contexto, está em canaltech.com.br — o conteúdo pertence a Canaltech.