Inteligência Artificial WebStory

OpenAI corta preços do GPT-6 Sol e Luna pela metade

OpenAI reduz preços do GPT-6 Sol e Luna em 50% e cobra menos que rivais. Testes mostram queda no custo por tarefa, mas também recuos de desempenho.
Imagem de: OpenAI corta preços do GPT-6 Sol e Luna pela metade

A OpenAI reduziu os preços do GPT-6 Sol e do GPT-6 Luna em 50% na comparação com as versões anteriores. Os dois modelos passam a custar menos que seus respectivos concorrentes.

O GPT-6 Sol tem preços abaixo dos cobrados pelo Claude Opus 5.5, da Anthropic. Já o GPT-6 Luna custa menos até que o DeepSeek V4.1 Flash nos horários de menor demanda.

A relação entre desempenho e custo dos dois modelos chega a um patamar sem precedentes. Nesse cenário, o preço deixa de justificar a escolha de modelos com pesos abertos.

A OpenAI e Anthropic lançaram novos modelos no mesmo dia, poucos dias após suas últimas versões. O ritmo indica que os pedidos para desacelerar o desenvolvimento da IA ficaram em segundo plano por enquanto.

Quanto custam o GPT-6 Sol e o GPT-6 Luna

Na API, o GPT-6 Sol custa US$ 2, cerca de R$ 10,40, por milhão de tokens de entrada, as unidades usadas para medir o conteúdo enviado ao modelo.

O GPT-6 Luna cobra US$ 0,10, aproximadamente R$ 0,52, pelo mesmo volume. Ambos custam metade do preço das versões anteriores.

No caso do Sol, os valores de entrada e saída também são 50% menores que os do Claude Opus 5.5. A saída corresponde ao conteúdo gerado pelo modelo.

O Luna fica abaixo até das tarifas do DeepSeek V4.1 Flash fora dos horários de pico: US$ 0,15, cerca de R$ 0,78, por milhão de tokens de entrada.

Para a saída, o DeepSeek cobra US$ 0,60, aproximadamente R$ 3,12, por milhão de tokens nesses horários. Ainda assim, marca 74,2 pontos no DeepSWE v1.1, contra cerca de 67 do Luna.

Custo por tarefa cai, mas Claude Opus 5.5 mantém a liderança

Segundo a OpenAI, o treinamento do GPT-6 Sol usou métodos semelhantes aos do GPT-6 Astra, com melhorias em raciocínio, precisão das informações, programação e uso do computador.

A empresa também cita avanços no alinhamento, que trata da adequação das respostas ao comportamento definido para o modelo.

Nos testes da Artificial Analysis, o GPT-6 Sol em modo max custa US$ 1,06 por tarefa típica no Intelligence Index, cerca de R$ 5,51. O valor é aproximadamente 50% menor que o do GPT-5.6 Sol no mesmo modo, de US$ 1,99, ou R$ 10,35.

Já o GPT-6 Luna em modo max custa US$ 0,07 por tarefa, cerca de R$ 0,36. A queda é de aproximadamente 60% sobre os US$ 0,18, ou R$ 0,94, do GPT-5.6 Luna.

Apesar da redução nos custos, o Claude Opus 5.5 lidera o Intelligence Index com 58 pontos. O GPT-6 Sol soma 48, uma pontuação um pouco abaixo das expectativas.

Modelos dão menos respostas erradas, mas também respondem menos

O GPT-6 Sol melhorou em programação. O GPT-6 Luna, por sua vez, teve uma pequena piora em relação ao GPT-5.6 Luna.

No AA-Omniscience Index, a taxa de alucinação, usada para medir respostas com informações inventadas ou incorretas, caiu de 92% para 60% no Sol em modo max.

No Luna, também em modo max, essa taxa passou de 93% para 77%. O Sol chegou a essa redução ao recusar mais perguntas.

As respostas erradas caíram cerca de um quarto, mas a taxa de acerto também recuou cinco pontos, para 54%. O Luna também respondeu a menos perguntas. Sua taxa de acerto ficou praticamente estável, em 44%.

GPT-6 Sol e Luna têm recuos em outros testes

Os dois modelos pioraram no GDPval-AA v2.1 com esforço máximo de raciocínio. A principal causa foram entregas mais curtas, que deixaram de incluir itens obrigatórios com maior frequência.

O GPT-6 Sol também ficou abaixo do GPT-5.6 Sol no DeepSWE, no uso do computador e na correção de erros em tarefas de pesquisa. Em segurança cibernética, manteve o desempenho.

O Claude Opus 5.5 chegou com capacidade para executar cerca de 100 agentes de IA em paralelo. O GPT-6 Astra já conta com uma capacidade semelhante.

Com os preços do Sol e do Luna, a OpenAI parece buscar uma relação mais vantajosa entre custo e desempenho.

Esse ponto ganha peso no OSWorld 2.0 Offline, o Claude Opus 5.5 em modo médio supera o GPT-6 Astra em modo máximo por um quinto do custo por tarefa.