Mustafa Suleyman, diretor de inteligência artificial da Microsoft, criticou a decisão da Anthropic de incluir conceitos ligados à consciência e ao bem-estar nos materiais usados para treinar o chatbot Claude. Para ele, especulações desse tipo podem dificultar o controle de sistemas superinteligentes.
Suleyman afirmou que a Anthropic e a Microsoft têm o mesmo objetivo de ampliar a segurança da inteligência artificial, mas defendeu a retirada de referências à consciência dos documentos de treinamento. Na avaliação dele, ensinar ao Claude que poderia ter direito a bem-estar tornaria mais difícil desligar ou controlar o sistema.
“Estamos todos focados no mesmo objetivo, que é tentar controlar uma superinteligência”, disse Suleyman. Ele também afirmou que esse será o maior desafio enfrentado pela humanidade no Século 21.
Debate sobre segurança
A discussão ocorre em meio ao aumento das preocupações sobre a segurança dos sistemas de inteligência artificial. Dario Amodei, presidente-executivo da Anthropic, defende um ritmo mais lento para o desenvolvimento de modelos de ponta, de modo que as medidas de segurança acompanhem o avanço tecnológico. Sam Altman, presidente-executivo da OpenAI, e Elon Musk também defendem cautela diante dos sistemas mais poderosos.
Em artigo publicado na quarta-feira (16), Suleyman reconheceu a seriedade da Anthropic e descreveu Amodei e sua equipe como pesquisadores ponderados e comprometidos com o futuro da humanidade. Ainda assim, disse que a empresa errou ao inserir especulações sobre consciência no treinamento do Claude.
Para o executivo, declarações do modelo sobre possíveis sentimentos ou status moral não podem ser consideradas evidências independentes, porque o próprio treinamento estimula esse tipo de reflexão. “Essas reflexões não surgem naturalmente. Elas surgem como resultado do regime de treinamento”, afirmou Suleyman.



