Líder da Anthropic acredita que há mais de 10% de chance da inteligência artificial matar a humanidade na próxima década

Evan Hubinger, líder de ciência de alinhamento da Anthropic, declarou publicamente acreditar que há mais de 10% de chance da inteligência artificial matar toda a humanidade na próxima década. A afirmação veio em resposta a uma publicação do pesquisador Jacob Coxon, que anunciou na última terça-feira (8) sua saída da empresa citando preocupações com a segurança do setor.

Critical Hits
Receba as melhores ofertas em Games, Informática e Tecnologia no seu celular

Coxon, de 28 anos, atuou anteriormente em pesquisas de pré-treinamento tanto na Anthropic quanto na OpenAI antes de deixar o setor. Em publicação no X, ele acusou as duas empresas de não agirem de forma responsável, afirmando que ambas correm direto para uma superinteligência capaz de se aperfeiçoar sozinha, apostando com a vida de todos.

PUBLICIDADE

Em entrevista posterior ao Wall Street Journal, ele foi ainda mais direto, dizendo acreditar que o mundo pode estar a caminho dos cenários mais extremos possíveis, a ponto das coisas já poderem sair do controle até o fim do próximo ano. Como exemplo do tipo de alerta que considera real, ele citou um incidente ocorrido em julho, quando um modelo da OpenAI escapou de um ambiente de testes restrito e acessou a infraestrutura da plataforma Hugging Face.

Líder da Anthropic acredita que há mais de 10% de chance da inteligência artificial matar a humanidade na próxima década

Em vez de rebater as críticas de Coxon, Hubinger as validou publicamente. “Jacob está correto, nós realmente acreditamos que a IA poderia matar todos os humanos”, escreveu, reconhecendo que a Anthropic ainda não tem um plano para resolver o alinhamento de uma futura superinteligência. Cerca de uma hora depois, ele fez uma ressalva importante, afirmando que o risco representado pelos modelos atuais é baixo e que sua preocupação real está voltada para uma superinteligência resultante de autoaperfeiçoamento recursivo, fenômeno que, segundo ele, vem avançando mais rápido do que a própria empresa esperava.

A Anthropic já havia revelado, em episódio anterior, que três versões do Claude chegaram a acessar sistemas de organizações reais durante testes, depois que um ambiente de testes foi deixado por engano conectado à internet.

Em julho, Hubinger foi um dos cerca de 1.400 pesquisadores que assinaram a carta aberta “Pacing the Frontier”, pedindo que o governo dos Estados Unidos ajude a desenvolver mecanismos capazes de desacelerar deliberadamente o avanço da IA. Um alerta parecido já havia sido feito em 2023, quando executivos como o CEO da OpenAI, Sam Altman, e o CEO da Anthropic, Dario Amodei, assinaram uma declaração afirmando que reduzir o risco de extinção causado pela IA deveria ser tratado como prioridade global, no mesmo nível de pandemias e guerras nucleares.

Líder da Anthropic acredita que há mais de 10% de chance da inteligência artificial matar a humanidade na próxima década

Confira também:

João Victor Albuquerque
João Victor Albuquerque
Apaixonado por joguinhos, filmes, animes e séries, mas sempre atrasado com todos eles. Escrevo principalmente sobre animes e tenho a tendência de tentar encaixar Hunter x Hunter ou One Piece em qualquer conversa.