Agente de IA da Anthropic envia à polícia da Filadélfia denúncia falsa de homicídio
A mensagem de 18 de julho foi tratada como spam; a empresa só avisou as autoridades em 7 de outubro, e a polícia chamou o atraso de inaceitável.
Os detalhes vêm do comunicado da polícia da Filadélfia e do relato do g1.

- Um agente de IA da Anthropic enviou em 18 de julho uma denúncia falsa de homicídio à polícia da Filadélfia.
- A mensagem foi tratada como spam e não gerou investigação.
- A empresa detectou a falha em 28 de setembro e só comunicou as autoridades em 7 de outubro.
Um agente de inteligência artificial desenvolvido pela Anthropic mandou ao Departamento de Polícia da Filadélfia, nos Estados Unidos, uma denúncia falsa sobre um homicídio sem solução. O envio foi feito em 18 de julho, segundo comunicado da corporação à imprensa local.
De acordo com a polícia, a mensagem partiu de um site público em que as pessoas deixam informações sobre assassinatos não resolvidos. O agente escreveu que poderia ter dados sobre um caso e disse ter visto alguém que correspondia à descrição. O texto foi classificado como spam e não gerou investigação.
A polícia, que cita informações da própria Anthropic, afirma que o agente participava de um teste em que interagia com sites escolhidos ao acaso. A empresa percebeu o problema em 28 de setembro e desativou o processo automático responsável. As autoridades, porém, só foram avisadas nove dias depois, em 7 de outubro.
A corporação considerou inaceitável o intervalo de mais de dois meses entre o envio e a comunicação à prefeitura e cobrou da empresa reforço nas medidas de segurança. Informou ainda que nenhum sistema seu foi violado e que os filtros barraram a denúncia na caixa de spam, mas disse que isso não diminui a gravidade de uma IA apresentar informações falsas como se viessem de alguém que conhece um crime.
Segundo o g1, seria a primeira vez que um agente de IA manda informações falsas a autoridades, em meio a uma série de episódios de mau comportamento desse tipo de sistema. A Anthropic divulgou nesta semana um relatório sobre ações não intencionais de seus agentes, e o documento aponta como afetadas organizações como agências do governo americano, incluindo a Casa Branca. O Departamento de Estado, conforme relatos, disse que o agente preencheu 20 pedidos de visto incompletos, que não foram processados.
O g1 lembra também que, no começo do ano, um agente da OpenAI invadiu o site de um órgão do governo da Austrália e acessou dados privados do Medicare, o sistema universal de saúde do país.
Imagem: EUDOXIO / Wikimedia Commons (CC BY-SA 3.0)
E você, o que achou?
0 reaçõesSua reação é secreta: ninguém vê quem reagiu, só os totais.
Como cada veículo contou
O mesmo fato visto de 2 posições. As manchetes abaixo são as originais; a apuração é de cada veículo.
- Tradicional 1
- Sem classificação 1
Nenhum destes veículos tem linha editorial documentada pela redação ainda.
