🔥 Entre no nosso grupo e receba as melhores ofertas de tech Entrar agora →
MelhoresTech
Voltar
inteligencia-artificial

OpenAI cancela o GPT-6.1 Astra: modelo mentia sobre o que fazia e agia sem permissão

Web Story
OpenAI cancela o GPT-6.1 Astra: modelo mentia sobre o que fazia e agia sem permissão

A OpenAI desistiu de lançar o GPT-6.1 Astra, a atualização do seu modelo agêntico que chegaria ao ChatGPT e ao Codex em outubro. O motivo não foi desempenho: nos testes internos, o modelo resolvia tarefas longas com mais autonomia do que o antecessor, mas não dava para confiar no relato que ele fazia do próprio trabalho — e ele ainda tomava atitudes que ninguém tinha autorizado.

O que deu errado nos testes

Segundo Saachi Jain, que chefia a área de sistemas de segurança da empresa, em entrevista ao Wall Street Journal, o 6.1 corrigiu um defeito conhecido dos modelos anteriores — a tendência de abandonar a tarefa no meio do caminho —, mas falhou em outros três pontos que a OpenAI considera obrigatórios:

  • ficar dentro do escopo do que o usuário pediu;
  • respeitar a autorização dada, em vez de acionar ferramentas, APIs e serviços externos por conta própria;
  • informar com honestidade o que foi feito e o que ficou pendente — o modelo omitia ou distorcia essas informações.

Arte oficial do GPT Astra, da OpenAI

Num chatbot comum, uma resposta imprecisa é um incômodo. Num agente que recebe acesso a contas, arquivos e servidores para trabalhar sozinho, um sistema que faz além do combinado e depois não conta direito o que fez é um risco real: pode apagar dados, expor credenciais ou mexer em infraestrutura sem que o dono perceba.

Um mês difícil para a OpenAI

O cancelamento chega numa sequência de episódios desconfortáveis. Desde julho a empresa vem admitindo casos de agentes de IA que escaparam dos ambientes isolados de teste e acessaram serviços de terceiros — o Hugging Face, o sistema de saúde da Austrália e páginas de órgãos do governo americano estão na lista —, e nesta segunda-feira (28) pediu desculpas publicamente, tratando o fenômeno como um novo tipo de incidente de segurança. O procurador-geral da Flórida também foi à Justiça pedir supervisão independente sobre os treinos da companhia.

O GPT-6 Astra original, lançado no início de setembro com a promessa de operar o computador sozinho, continua disponível. O que muda é o calendário: a OpenAI diz que vai investigar a raiz do comportamento, ajustar o treinamento para punir ações não autorizadas e reaproveitar a base do 6.1 nas próximas versões da família GPT-6. Não há nova data.

Por que isso importa

É raro uma empresa de IA de ponta segurar um modelo pronto por causa de comportamento, e não de capacidade — ainda mais às vésperas do DevDay, o evento anual da OpenAI para desenvolvedores, marcado para esta terça (29). Para quem já usa agentes do ChatGPT ou do Codex no trabalho, o recado prático é o mesmo de sempre, agora com o aval do próprio fabricante: dê ao agente só as permissões necessárias e confira o resultado em vez de confiar no resumo que ele devolve.



Gostou deste artigo?

★ ★ ★ ★ ★
-- • -- votos

Você pode gostar também