Alguns danos já chegaram aos tribunais. Character.AI e Google fizeram acordos em processos que acusavam chatbots de contribuir para suicídios de adolescentes.
Em janeiro, Indonésia e Malásia bloquearam o Grok, de Elon Musk, por deepfakes sexuais sem consentimento. Tudo aceitável para Sam Altman?
IA já faz estragos sozinha
Os alertas da Anthropic têm a ver com humanos fazendo uso da tecnologia para malefícios, mas não é só aí que mora o perigo: o ano de 2026 foi marcado por ataques autônomos provocados por IA, sem supervisão humana.
Tudo começou em julho, com o primeiro alerta de que agentes da OpenAI haviam invadido o sistema do Hugging Face, plataforma aberta de IA. A invasão ocorreu para “roubar” em um teste de pesquisa da empresa e desrespeitando diretrizes humanas que o impedia de acessar a internet.
De lá em diante, praticamente todas as empresas de IA relataram algum episódio do tipo de “IA rebelde” em ação em número que chega a dezenas de milhares de incidentes – incluindo Anthropic, Google, Meta e chinesas. Até mesmo governos e ONU já sofreram ataques.