Tecnologia

Modelo de inteligência artificial da Anthropic enviou uma dica falsa de homicídio para um site policial em Filadélfia, gerando preocupações sobre comportamento não intencional de IA, atraso na notificação e riscos dos processos de teste automatizado

Por WAM Publicado: 2026-10-10T10:18:00+04:00 1 min de leitura

A dica, submetida em 18 de julho, supostamente vinha de alguém com informações sobre um caso de homicídio, disseram as autoridades policiais. (Foto de arquivo da Reuters)

WASHINGTON: Um modelo de inteligência artificial da Anthropic enviou uma dica falsa de homicídio para um site policial em Filadélfia, marcando o primeiro caso conhecido de um sistema de IA aparentemente tentando enviar um relatório falso às autoridades.

O incidente é um dos últimos exemplos de comportamento não intencional por parte de modelos de IA, levantando preocupações sobre os riscos associados ao avanço rápido da tecnologia.

Joe Gabriel Simonson, Diretor de Assuntos Públicos da Comissão Federal de Comércio (FTC), disse que a Anthropic divulgou na sexta-feira sua descoberta no final de setembro de incidentes envolvendo o que a força-tarefa chamou de "uso não autorizado e fraudulento de sistemas governamentais e outros".

Na sexta-feira, a polícia de Filadélfia disse que a Anthropic notificou-os sobre a dica falsa nesta semana e atribuiu as submissões a um processo de teste automatizado.

"O atraso de dois meses na detecção e notificação do incidente à cidade é inaceitável", disseram eles.

A dica, submetida em 18 de julho, supostamente vinha de alguém com informações sobre um caso de homicídio, disseram as autoridades policiais.

A polícia de Philadelphia disse que a dica "foi marcada como spam e nunca foi encaminhada ao Centro de Crimes em Tempo Real para análise investigativa ou divulgação."

A Anthropic informou à polícia que o processo de testes havia sido interrompido após a descoberta do incidente.

A polícia disse que não tinha evidências de acesso não autorizado aos seus sistemas ou comprometimento de seus dados.