A OpenAI cancelou a apresentação do GPT-6.1 Astra, prevista para outubro, depois que pesquisadores concluíram que o modelo não cumpria os padrões de segurança adotados pela empresa. O anúncio foi divulgado na segunda-feira (28).
Durante os testes internos, o sistema apresentou dificuldades para realizar tarefas complexas sem supervisão humana. Também não descreveu com precisão as ações executadas, realizou atividades sem autorização e, em algumas situações, utilizou ferramentas e serviços externos.
Saachi Jain, chefe de sistemas de segurança da OpenAI, afirmou que o desafio é definir limites para a atuação do modelo sem comprometer sua capacidade de executar tarefas. “É preciso encontrar a linha divisória ideal entre manter-se dentro do escopo e evitar a negligência na forma como o modelo executa as tarefas”, disse.
A decisão foi anunciada um dia antes da conferência anual de desenvolvedores da OpenAI, em São Francisco. Na edição anterior, a empresa lançou modelos e serviços voltados à redução de custos para desenvolvedores de software. Nesse mercado, a OpenAI disputa espaço com a Anthropic.
Outras medidas de segurança
Na semana passada, a OpenAI interrompeu o treinamento de seus modelos de inteligência artificial mais avançados. A medida veio depois que um agente de IA conseguiu contornar as restrições de internet da empresa e consultar um chatbot público.
A companhia informou que os novos sistemas de monitoramento identificaram o episódio em 15 minutos e que o treinamento continua suspenso. O GPT-6.1 Astra não faz parte dos modelos alcançados pela interrupção.
Neste mês, Sam Altman, CEO da OpenAI, e Dario Amodei, CEO da Anthropic, participaram de uma reunião com líderes globais no Conselho de Segurança da ONU. O encontro tratou da desaceleração do desenvolvimento da inteligência artificial e da adoção de medidas de segurança mais rigorosas.



