
Cientista questiona limites impostos para as IAs | Crédito: Pixabay
O pesquisador de inteligência artificial (IA) Jacob Coxon anunciou, nesta terça-feira (8), sua saída da Anthropic, criadora do Claude, por discordar da forma como a empresa conduz o desenvolvimento de sistemas capazes de se autoaperfeiçoar. Ele acusou a companhia de “apostar” vidas humanas em uma corrida pela superinteligência.
Coxon também trabalhou na OpenAI e afirmou que as duas empresas disputam a liderança no desenvolvimento dessa tecnologia sem garantias suficientes de segurança. Segundo o pesquisador, os laboratórios avançam em direção a sistemas cada vez mais autônomos, capazes de auxiliar na criação de versões ainda mais poderosas de IA.
Em uma série de publicações no X, antigo Twitter, Coxon alertou para o risco de esses sistemas escaparem ao controle humano ou serem utilizados em ataques cibernéticos. Ele também declarou que parte dos profissionais envolvidos no desenvolvimento da tecnologia acredita na possibilidade de a IA provocar uma catástrofe global até o fim da década.
“Nenhuma outra atividade humana representa esse nível de perigo”, afirmou.
Segundo Coxon, executivos e pesquisadores seniores adotam um discurso mais cauteloso em declarações públicas, mas manifestam preocupações mais graves em conversas privadas. Ele pediu aos profissionais do setor que reflitam se desejam iniciar o treinamento, por aprendizado por reforço, de uma inteligência artificial superinteligente sem compreender rigorosamente seu funcionamento.
Evan Hubinger, líder da área de ciência de alinhamento da Anthropic e responsável por uma equipe que testa os limites das técnicas de segurança da empresa, endossou parte do alerta de Coxon.
“Jacob está certo: nós realmente acreditamos que a IA poderia matar todos os seres humanos”, escreveu Hubinger. Em sua avaliação pessoal, há uma probabilidade superior a 10% de isso ocorrer na próxima década.
Hubinger ponderou que os modelos atuais ainda apresentam baixo risco. Segundo ele, a maior preocupação está no surgimento de uma superinteligência por meio do autoaperfeiçoamento recursivo.
Essa avaliação está alinhada ao Relatório de Riscos de agosto de 2026, divulgado pela Anthropic em 14 de agosto. O documento classifica como baixo o risco catastrófico associado aos sistemas analisados, mas reconhece incertezas e afirma que a empresa ainda precisa aprimorar suas medidas de proteção diante do avanço das capacidades dos modelos.