A inteligência artificial geral, conhecida pela sigla AGI, é um conceito que descreve sistemas capazes de raciocinar e resolver problemas de maneira semelhante aos seres humanos. Diferentemente dos modelos atuais, geralmente voltados a tarefas específicas, a AGI teria maior autonomia, capacidade de encadear pensamentos e flexibilidade para lidar com diferentes situações.
O tema ganhou destaque após o lançamento do GPT-6 Astra, da OpenAI. O modelo apresentou avanços em tarefas autônomas e no controle de computadores. Greg Brockman, presidente e cofundador da empresa, afirmou que o lançamento marca o “início da era da AGI”.
Um estágio ainda hipotético
A AGI ainda não foi alcançada. Mesmo assim, a evolução dos modelos de inteligência artificial alimenta a possibilidade de que esse nível seja atingido no futuro. O ChatGPT, lançado em 2022 como uma ferramenta de texto que apresentava alucinações, tornou-se um agente capaz de realizar tarefas autônomas no espaço de quatro anos.
A transição pode ocorrer de forma gradual, com avanços sucessivos, em vez de depender de um único modelo que concentre toda a evolução. O conceito também funciona como referência para o desenvolvimento tecnológico. Há ainda uma disputa entre empresas, já que a primeira a atingir esse nível poderia ganhar a corrida da inteligência artificial e ampliar seu valor de mercado.
Como medir a AGI
Como não existe uma definição consensual para esse estágio, permanece o desafio de estabelecer quando ele terá sido atingido. OpenAI e Microsoft mantêm um acordo para que um grupo independente avalie se a criadora do ChatGPT alcançou a superinteligência.
Os benchmarks são outra forma de acompanhar o desempenho dos modelos. Entre eles está o ARC-AGI, desenvolvido pela ARC, com desafios interativos destinados a humanos e máquinas. O teste chegou à terceira versão, e o GPT-6 foi apresentado com a maior nota do mercado na avaliação, acima do resultado do Claude Opus 5, da Anthropic.
Ainda assim, uma pontuação elevada não basta para declarar o início de uma nova era. Outros testes e situações de uso diário também são considerados na avaliação dos sistemas de inteligência artificial.



