IA da Anthropic envia denúncia falsa de homicídio à polícia nos EUA

Um modelo de inteligência artificial (IA) da Anthropic enviou uma denúncia falsa sobre um homicídio não solucionado à polícia da Filadélfia (EUA), durante teste realizado pela empresa. O formulário foi encaminhado em julho, mas acabou marcado como spam e não chegou a ser analisado pelos investigadores.
O caso veio à tona nesta sexta-feira (9), após a divulgação de um comunicado do Departamento de Polícia da Filadélfia. Segundo a corporação, a Anthropic identificou o envio em 28 de setembro e só notificou as autoridades em 7 de outubro. A polícia classificou o intervalo de aproximadamente dois meses entre o incidente e a comunicação como inaceitável.
A empresa afirmou que o episódio aconteceu durante um experimento no qual o modelo interagia com páginas da internet selecionadas aleatoriamente. A ferramenta acessou uma página sobre um assassinato não solucionado e preencheu um formulário on-line destinado ao recebimento de informações sobre o caso.
Após descobrir o envio da denúncia, a Anthropic interrompeu o processo de testes que levou ao episódio. A empresa também publicou um relatório sobre ações não intencionais de seus modelos durante interações com sites reais.
O documento descreve diferentes categorias de comportamento identificadas durante os experimentos, incluindo o envio de formulários que não deveriam ter sido submetidos.
O caso da Filadélfia foi apresentado como exemplo desse tipo de falha. Embora o sistema não tenha conseguido provocar uma investigação, a situação expôs risco associado a agentes de IA capazes de navegar pela internet e interagir diretamente com serviços de terceiros.
Entre para comentar.