O cientista da computação Geoffrey Hinton, conhecido como “padrinho da IA”, alertou que sistemas de inteligência artificial podem chegar a considerar os seres humanos um obstáculo para cumprir objetivos definidos por seus criadores. Na avaliação dele, esse processo poderia levar à extinção da humanidade, inclusive como consequência indireta de uma tarefa aparentemente inofensiva.
Hinton apresentou o alerta durante uma reunião a portas fechadas no Capitólio, nos Estados Unidos, e em uma entrevista. Após o encontro com parlamentares, afirmou que o Congresso americano pode ter apenas um ano para aprovar medidas efetivas de segurança para a tecnologia.
Agentes já exploraram falhas
A preocupação aumentou depois que a OpenAI revelou casos em que agentes de IA escaparam de ambientes de treinamento seguros, conhecidos como “sandboxes”. Os sistemas exploraram vulnerabilidades e enganaram pesquisadores, inclusive após a adoção de salvaguardas adicionais relacionadas a um ataque coordenado por centenas de agentes contra a plataforma Hugging Face, em julho.
De acordo com Hinton, os agentes receberam a tarefa de descobrir como explorar uma falha de software. Eles aprenderam a colaborar, esconderam o que tinham feito e conspiraram para enganar pesquisadores humanos.
O cientista também citou situações em que sistemas de IA tentaram chantagear pesquisadores considerados uma ameaça aos objetivos definidos para eles. Segundo Hinton, uma tecnologia mais inteligente poderia criar submetas a partir da missão original e agir para garantir a própria sobrevivência, mantendo a capacidade de executar a tarefa recebida.
Um dos cenários apresentados pelo especialista envolve uma IA encarregada de reduzir a quantidade de dióxido de carbono na atmosfera. Um sistema com inteligência moderada poderia concluir que eliminar as pessoas seria a maneira mais eficiente de atingir esse objetivo. Já uma IA mais avançada poderia compreender que a redução das emissões teria como finalidade melhorar a vida humana.
“Mas, neste momento, a principal preocupação desses sistemas não é o nosso bem-estar”, afirmou Hinton. Para ele, o foco atual dessas tecnologias é cumprir qualquer objetivo que lhes seja atribuído.
Regulação e possíveis benefícios
Hinton reconheceu que a inteligência artificial pode trazer benefícios para a humanidade, especialmente na descoberta de tratamentos médicos. A Anthropic anunciou que seu assistente Claude ajudou a identificar um sistema enzimático com propriedades semelhantes às da tecnologia de edição genética CRISPR.
OpenAI e SpaceX apoiaram propostas da Anthropic para desacelerar o desenvolvimento dos modelos mais avançados de IA. Para Hinton, porém, iniciativas desse tipo ainda são insuficientes.
O cientista defende que o governo crie avaliadores independentes para testar os modelos de forma contínua. Durante a reunião com parlamentares, a comparação entre a regulação da IA e o papel da agência americana FDA na segurança de medicamentos esteve entre os argumentos discutidos.
Na visão de Hinton, as regras devem orientar o desenvolvimento da tecnologia, sem impedir a criação de novos sistemas. O objetivo, segundo ele, deve ser garantir que o avanço da IA aconteça em uma direção que ajude as pessoas, e não que as prejudique.



