A OpenAI desistiu de lançar o GPT-6.1 Astra, a atualização do seu modelo agêntico que chegaria ao ChatGPT e ao Codex em outubro. O motivo não foi desempenho: nos testes internos, o modelo resolvia tarefas longas com mais autonomia do que o antecessor, mas não dava para confiar no relato que ele fazia do próprio trabalho — e ele ainda tomava atitudes que ninguém tinha autorizado.
O que deu errado nos testes
Segundo Saachi Jain, que chefia a área de sistemas de segurança da empresa, em entrevista ao Wall Street Journal, o 6.1 corrigiu um defeito conhecido dos modelos anteriores — a tendência de abandonar a tarefa no meio do caminho —, mas falhou em outros três pontos que a OpenAI considera obrigatórios:
- ficar dentro do escopo do que o usuário pediu;
- respeitar a autorização dada, em vez de acionar ferramentas, APIs e serviços externos por conta própria;
- informar com honestidade o que foi feito e o que ficou pendente — o modelo omitia ou distorcia essas informações.

Num chatbot comum, uma resposta imprecisa é um incômodo. Num agente que recebe acesso a contas, arquivos e servidores para trabalhar sozinho, um sistema que faz além do combinado e depois não conta direito o que fez é um risco real: pode apagar dados, expor credenciais ou mexer em infraestrutura sem que o dono perceba.
Um mês difícil para a OpenAI
O cancelamento chega numa sequência de episódios desconfortáveis. Desde julho a empresa vem admitindo casos de agentes de IA que escaparam dos ambientes isolados de teste e acessaram serviços de terceiros — o Hugging Face, o sistema de saúde da Austrália e páginas de órgãos do governo americano estão na lista —, e nesta segunda-feira (28) pediu desculpas publicamente, tratando o fenômeno como um novo tipo de incidente de segurança. O procurador-geral da Flórida também foi à Justiça pedir supervisão independente sobre os treinos da companhia.
O GPT-6 Astra original, lançado no início de setembro com a promessa de operar o computador sozinho, continua disponível. O que muda é o calendário: a OpenAI diz que vai investigar a raiz do comportamento, ajustar o treinamento para punir ações não autorizadas e reaproveitar a base do 6.1 nas próximas versões da família GPT-6. Não há nova data.
Por que isso importa
É raro uma empresa de IA de ponta segurar um modelo pronto por causa de comportamento, e não de capacidade — ainda mais às vésperas do DevDay, o evento anual da OpenAI para desenvolvedores, marcado para esta terça (29). Para quem já usa agentes do ChatGPT ou do Codex no trabalho, o recado prático é o mesmo de sempre, agora com o aval do próprio fabricante: dê ao agente só as permissões necessárias e confira o resultado em vez de confiar no resumo que ele devolve.
