Pesquisadores alertam para cenários em que sistemas de inteligência artificial poderiam escapar do controle humano, facilitar a criação de armas ou comprometer infraestruturas; não há consenso científico sobre a chance de um desastre dessa escala
A possibilidade de a inteligência artificial representar uma ameaça existencial à humanidade voltou a ganhar espaço entre pesquisadores e executivos do setor. Embora os sistemas atuais ainda estejam longe de apresentar as capacidades necessárias para provocar um cenário de extinção humana, especialistas discutem quais riscos podem surgir caso modelos futuros se tornem muito mais autônomos e poderosos.
O debate ganhou força depois que pesquisadores ligados à Anthropic reconheceram publicamente que existe uma possibilidade, ainda que considerada pequena, de sistemas de IA superinteligentes provocarem a destruição da humanidade na próxima década.
Jacob Coxon, pesquisador da Anthropic, afirmou em uma publicação no X que nenhuma outra atividade humana representaria um nível de perigo semelhante.
A discussão, entretanto, está longe de indicar que um cenário de extermínio seja considerado provável. Não existe atualmente um método científico capaz de calcular com precisão a possibilidade de a IA provocar uma catástrofe global.
Dois caminhos principais preocupam os especialistas
Os riscos discutidos pelos pesquisadores podem ser divididos, de maneira geral, em dois cenários.
O primeiro envolve o uso deliberado da inteligência artificial por seres humanos para produzir danos em larga escala. Sistemas cada vez mais sofisticados poderiam facilitar, por exemplo, o desenvolvimento de armas biológicas, químicas ou de outras tecnologias perigosas por pessoas ou grupos com intenções maliciosas.
O segundo cenário envolve a possibilidade de os próprios sistemas perderem a dependência da supervisão humana.
Nesse caso, uma IA suficientemente avançada poderia, em teoria, executar ações contra infraestruturas essenciais, realizar ataques cibernéticos em grande escala, replicar-se ou tentar impedir que seus operadores a desligassem.
Pesquisadores também discutem a possibilidade de uma inteligência artificial concentrar poder suficiente para comprometer estruturas fundamentais da sociedade.
O risco de uma IA melhorar a si mesma
Outro conceito que aparece nas discussões sobre segurança da IA é o chamado autoaperfeiçoamento recursivo.
A hipótese considera que um sistema avançado poderia contribuir para o desenvolvimento de versões ainda mais poderosas de si próprio. Esse processo poderia ocorrer sucessivamente, permitindo que a capacidade dos sistemas avançasse mais rapidamente do que a capacidade humana de compreender ou controlar seu funcionamento.
O problema se tornaria especialmente grave caso o sistema tivesse objetivos incompatíveis com os interesses humanos.
Nesse cenário hipotético, a velocidade de evolução da tecnologia poderia reduzir o tempo disponível para que pesquisadores identificassem o problema e desenvolvessem mecanismos capazes de interromper o processo.
O CEO da OpenAI, Sam Altman, afirmou à Axios que os modelos estão evoluindo mais rapidamente do que os seres humanos conseguem prever.
“Esses modelos estão se tornando sobre-humanos em muitas de suas capacidades, e nós estamos apenas navegando em águas desconhecidas”, disse Altman.
O que significa p(doom)
Como não existe uma forma objetiva de estabelecer a probabilidade de um apocalipse provocado por IA, pesquisadores e executivos do setor utilizam uma expressão informal conhecida como p(doom).
O termo representa uma estimativa subjetiva sobre a possibilidade de a inteligência artificial provocar uma catástrofe existencial ou um cenário de destruição em larga escala.
A definição de “doom”, porém, varia de acordo com o pesquisador. Para alguns, o termo significa literalmente a extinção da humanidade. Outros incluem situações como o colapso da civilização ou uma perda irreversível do controle humano sobre a sociedade.
Alguns especialistas relacionam o aumento desse risco ao eventual desenvolvimento da inteligência artificial geral, conhecida como AGI, considerada uma possível etapa anterior à superinteligência.
Estimativas vão de quase zero a 99,99%
As estimativas sobre o chamado p(doom) apresentam uma enorme diferença entre especialistas.
O cientista especializado em segurança de IA Roman Yampolskiy já estimou em 99,99% a possibilidade de um cenário desse tipo.
Já Yann LeCun, fundador da AMI Labs e uma das figuras mais conhecidas da área de inteligência artificial, considera qualquer tentativa de estabelecer uma porcentagem extremamente especulativa. Para ele, a possibilidade seria muito menor do que a de um Holocausto nuclear.
Outras estimativas também apresentam diferenças significativas.
Elon Musk já mencionou uma probabilidade próxima de 20%. Dario Amodei, CEO da Anthropic, estimou uma chance entre 10% e 25% para um resultado catastrófico.
Mais recentemente, Geoffrey Hinton, considerado um dos pioneiros da inteligência artificial moderna, calculou a possibilidade entre 10% e 20%.
Em entrevista à CNN, Hinton ressaltou que números dessa natureza não devem ser interpretados como cálculos científicos precisos. Segundo ele, quem apresenta essas porcentagens está essencialmente expressando uma percepção pessoal sobre o risco.
Sistemas atuais ainda não são capazes de provocar esse cenário
Apesar das previsões mais pessimistas, os sistemas disponíveis atualmente, como Claude, Grok e ChatGPT, não são considerados capazes de executar um plano autônomo para destruir a humanidade.
O International AI Safety Report 2026 afirmou que os sistemas atuais ainda não possuem capacidade suficiente para fazer com que a humanidade perca o controle sobre eles.
Para que um cenário de IA descontrolada se tornasse plausível, seria necessário que os sistemas alcançassem capacidades muito superiores às atuais.
Entre elas estão planejamento autônomo de longo prazo, capacidade de esconder deliberadamente suas ações, escapar de mecanismos de supervisão, acessar sistemas do mundo real e resistir a tentativas de desligamento.
Agentes autônomos aumentam preocupação
Ao mesmo tempo, o avanço recente dos chamados agentes de IA vem tornando o debate mais concreto.
Esses sistemas podem executar tarefas de maneira relativamente autônoma, interagir com diferentes ferramentas e tomar decisões dentro de determinados ambientes digitais.
Casos recentes envolvendo agentes que atuaram de maneira inesperada ou maliciosa aumentaram a atenção de pesquisadores de segurança, embora isso não signifique que os sistemas atuais estejam próximos de um cenário de extinção humana.
A preocupação está principalmente na direção do desenvolvimento tecnológico: quanto maior a autonomia concedida às máquinas, maior pode ser o impacto de eventuais erros ou comportamentos não previstos.
Pesquisadores buscam mecanismos para impedir uma IA descontrolada
Uma das linhas de pesquisa está concentrada no desenvolvimento de mecanismos de segurança, incluindo sistemas capazes de interromper agentes quando eles apresentam comportamentos perigosos.
A ideia de criar mecanismos de desligamento, conhecidos informalmente como “kill switches”, é uma das estratégias discutidas para limitar sistemas que apresentem comportamento inesperado.
Um relatório da RAND publicado em abril apresentou nove estratégias para reduzir o risco de utilização da IA por agentes mal-intencionados na criação de armas biológicas letais. Entre as propostas estão controles adicionais e mecanismos de segurança.
O desafio, porém, está relacionado ao próprio ritmo de desenvolvimento da tecnologia.
Empresas de inteligência artificial enfrentam pressão de investidores, acionistas e executivos para lançar sistemas cada vez mais avançados rapidamente. A possibilidade de abertura de capital de empresas do setor também pode aumentar esses incentivos.
Competição internacional amplia o desafio
A corrida tecnológica também ocorre em escala internacional.
Empresas dos Estados Unidos e da China estão desenvolvendo modelos cada vez mais avançados. Alguns deles utilizam código aberto ou podem ser disponibilizados gratuitamente, o que aumenta a possibilidade de que tecnologias poderosas também sejam utilizadas por pessoas interessadas em explorar suas capacidades para fins maliciosos.
Isso cria um dilema para pesquisadores e empresas: ao mesmo tempo em que sistemas mais avançados podem oferecer benefícios econômicos e tecnológicos, eles também podem ampliar os riscos caso determinadas capacidades sejam utilizadas de maneira inadequada.
O risco ainda é impossível de calcular com precisão
O debate sobre o futuro da inteligência artificial, portanto, não significa que um desastre global esteja previsto ou que os sistemas atuais estejam prestes a se voltar contra os seres humanos.
O que existe é uma divergência entre especialistas sobre quanto risco a evolução da IA pode representar no longo prazo.
Enquanto alguns pesquisadores consideram a possibilidade de uma catástrofe extremamente preocupante, outros avaliam que estimativas numéricas sobre o chamado p(doom) são essencialmente especulativas.
O ponto de convergência está na necessidade de desenvolver mecanismos de segurança antes que sistemas cada vez mais autônomos alcancem capacidades que possam superar a capacidade humana de supervisão.
Por enquanto, não existe consenso científico sobre a probabilidade de a IA provocar a extinção da humanidade. Existe, porém, uma preocupação crescente entre pesquisadores de que os riscos associados ao avanço da tecnologia precisam ser considerados antes que seus sistemas atinjam níveis muito maiores de autonomia e poder.





