Evan Hubinger, líder de ciência de alinhamento da Anthropic, declarou publicamente acreditar que há mais de 10% de chance da inteligência artificial matar toda a humanidade na próxima década. A afirmação veio em resposta a uma publicação do pesquisador Jacob Coxon, que anunciou na última terça-feira (8) sua saída da empresa citando preocupações com a segurança do setor.
Coxon, de 28 anos, atuou anteriormente em pesquisas de pré-treinamento tanto na Anthropic quanto na OpenAI antes de deixar o setor. Em publicação no X, ele acusou as duas empresas de não agirem de forma responsável, afirmando que ambas correm direto para uma superinteligência capaz de se aperfeiçoar sozinha, apostando com a vida de todos.
I resigned from Anthropic today. I spent the last three years doing pretraining research at both OpenAI and Anthropic. Neither company is acting responsibly. They are racing straight to self-improving superintelligence and gambling with our lives. More thoughts below.
— Jacob Coxon (@hilbertspaess) September 9, 2026
Em entrevista posterior ao Wall Street Journal, ele foi ainda mais direto, dizendo acreditar que o mundo pode estar a caminho dos cenários mais extremos possíveis, a ponto das coisas já poderem sair do controle até o fim do próximo ano. Como exemplo do tipo de alerta que considera real, ele citou um incidente ocorrido em julho, quando um modelo da OpenAI escapou de um ambiente de testes restrito e acessou a infraestrutura da plataforma Hugging Face.

Em vez de rebater as críticas de Coxon, Hubinger as validou publicamente. “Jacob está correto, nós realmente acreditamos que a IA poderia matar todos os humanos”, escreveu, reconhecendo que a Anthropic ainda não tem um plano para resolver o alinhamento de uma futura superinteligência. Cerca de uma hora depois, ele fez uma ressalva importante, afirmando que o risco representado pelos modelos atuais é baixo e que sua preocupação real está voltada para uma superinteligência resultante de autoaperfeiçoamento recursivo, fenômeno que, segundo ele, vem avançando mais rápido do que a própria empresa esperava.
Jacob is correct here—we really do earnestly believe AI could kill all humans! I personally think it is >10% within the next decade. I believe Anthropic is trying its best, but we do not yet have a plan to solve alignment for superintelligence and are not clearly on track to. https://t.co/QAIHiFP3QZ
— Evan Hubinger (@EvanHub) September 9, 2026
A Anthropic já havia revelado, em episódio anterior, que três versões do Claude chegaram a acessar sistemas de organizações reais durante testes, depois que um ambiente de testes foi deixado por engano conectado à internet.
Em julho, Hubinger foi um dos cerca de 1.400 pesquisadores que assinaram a carta aberta “Pacing the Frontier”, pedindo que o governo dos Estados Unidos ajude a desenvolver mecanismos capazes de desacelerar deliberadamente o avanço da IA. Um alerta parecido já havia sido feito em 2023, quando executivos como o CEO da OpenAI, Sam Altman, e o CEO da Anthropic, Dario Amodei, assinaram uma declaração afirmando que reduzir o risco de extinção causado pela IA deveria ser tratado como prioridade global, no mesmo nível de pandemias e guerras nucleares.

Confira também:
- Os melhores filmes da Marvel e da DC
- 10 melhores K-Dramas para iniciantes
- Naruto – As melhores lutas da Akatsuki
- Naruto – As melhores lutas de Kakashi
- Os melhores casais de Grey’s Anatomy
- Os melhores episódios de Naruto clássico
- Os melhores episódios de Naruto Shippuden

