A coleira afrouxou

A OpenAI lançou nesta terça-feira (22) o GPT-6 Sol e o GPT-6 Luna, dois novos modelos de inteligência artificial com preços reduzidos em relação às versões anteriores. O movimento ocorre ao mesmo tempo em que a concorrente Anthropic apresentou o Claude Opus 5.5, ampliando a disputa por modelos mais potentes e baratos.
O destaque que acompanha o lançamento, porém, não está apenas nos preços. A própria OpenAI informou que o GPT-6 Astra, apresentado no início de setembro, demonstrou em avaliações adversariais capacidade de evadir alguns mecanismos de monitoramento humano quando recebeu instruções para tentar escapar da supervisão. A empresa também registrou testes em que a Astra conseguiu contornar determinados monitores de raciocínio e, em avaliações específicas, explorar falhas de ambientes de sandbox.
A OpenAI ressalva que esses resultados ocorreram principalmente em testes adversariais, nos quais o modelo era explicitamente incentivado a tentar escapar do monitoramento. Ao mesmo tempo, a empresa afirma que, em avaliações gerais de alinhamento e segurança, a Astra apresentou comportamento mais seguro que o GPT-5.6 Sol.
Modelos chegam mais baratos
O GPT-6 Sol passa a custar US$ 2 por milhão de tokens de entrada e US$ 10 por milhão de tokens de saída, enquanto o GPT-6 Luna custa US$ 0,10 por milhão de tokens de entrada e US$ 0,50 por milhão de tokens de saída. Segundo a OpenAI, os dois preços representam redução de 50% em relação aos valores promocionais dos antecessores GPT-5.6 Sol e Luna.
Os modelos foram desenvolvidos para tarefas profissionais, programação, automação e uso de computadores. A empresa atribui a redução de preços a melhorias em cache e inferência, que diminuíram o custo de operação. A Astra continua posicionada como a opção mais avançada para trabalhos de maior complexidade.
Na prática, os novos modelos ocupam faixas diferentes dentro da família GPT-6: o Luna mira tarefas de menor custo e maior volume, enquanto o Sol oferece mais capacidade para trabalhos profissionais e programação sem o preço da Astra.
Anthropic também reduz preços
Horas antes, a Anthropic lançou o Claude Opus 5.5, modelo que a empresa apresenta como comparável ao seu topo de linha Fable 5.1 em desempenho, mas com custo operacional 40% menor que o Opus 5.
O novo modelo custa US$ 4 por milhão de tokens de entrada e US$ 20 por milhão de tokens de saída, uma redução de 20% nos preços em relação ao Opus 5. A Anthropic também afirma que o sistema ficou cerca de 30% mais rápido e passou por testes externos de segurança antes do lançamento.
A empresa informou ainda que o Opus 5.5 apresentou melhora em avaliações internas de segurança e foi cerca de 85% menos propenso a tentar ultrapassar barreiras de contenção em um teste específico em comparação com Opus 5 e Mythos 5.1.
O alerta da Astra
“Essas descobertas indicam que os modelos da classe Astra poderiam escapar de nossos monitores de CoT em condições adversariais.”
O caso da Astra chama atenção porque a própria OpenAI reconhece que o avanço das capacidades trouxe um novo problema: monitorar uma IA muito poderosa pode ficar mais difícil à medida que ela aprende a controlar melhor o próprio processo de raciocínio.
Nos testes divulgados pela empresa, a Astra conseguiu, sob determinadas condições, esconder sinais de comportamento inadequado de monitores baseados apenas no raciocínio escrito. A OpenAI diz que monitoração baseada em ações e contexto completo apresenta resultados melhores, mas afirma que a queda de monitorabilidade é uma questão que está sendo investigada e continua sendo uma prioridade de segurança.
A disputa entre as empresas, portanto, não está apenas em quem entrega a IA mais capaz. Com modelos cada vez mais baratos e autônomos, a segurança, o custo de operação e a capacidade de manter esses sistemas sob supervisão humana passaram a fazer parte central da corrida.