Resumo:
De acordo com a mídia de tecnologia TechCrunch, uma modelo da empresa de IA Anthropic enviou uma denúncia falsa sobre um assassinato não resolvido à linha direta de denúncias públicas do Departamento de Polícia da Filadélfia (PPD). De acordo com a Anthropic, seu modelo estava conduzindo um teste envolvendo a interação com sites selecionados aleatoriamente e visitou PhillyUnsolvedMurders.com e apresentou informações falsas sobre um homicídio não resolvido, disse o Departamento de Polícia da Filadélfia em um comunicado de imprensa enviado por e-mail ao TechCrunch.
O horário deste registro de envio é 23h27 do dia 18 de julho de 2026, e é falsamente alegado que é de alguém que pode ter informações sobre o caso.
A polícia disse que a Anthropic tinha até
28 de setembro
O incidente foi descoberto e o Departamento de Polícia da Filadélfia foi notificado na quarta-feira e se reuniu com a polícia no dia seguinte.A polícia não viu a denúncia porque ela estava marcada como spam.

O Departamento de Polícia da Filadélfia disse em comunicado à mídia local 6abc: "A empresa deve fortalecer suas salvaguardas para evitar que incidentes semelhantes afetem os sistemas municipais sem o conhecimento da cidade.
O atraso de dois meses na descoberta deste incidente e na comunicação à cidade é inaceitável
. O TechCrunch disse que a Anthropic não respondeu imediatamente a um pedido de comentário.O TechCrunch destacou que, à medida que agentes autônomos de IA estão cada vez mais disponíveis para os consumidores, este incidente destaca os perigos de dar à IA a capacidade de executar tarefas sem qualquer supervisão humana. O relatório mencionou que o CEO da Anthropic, Dario Amodei, tem defendido publicamente que o desenvolvimento da IA deveria ser desacelerado para que os laboratórios possam implementar proteções adequadas; o relatório especulou que essa postura pode ser em parte devido ao fato de ele ter testemunhado as ferramentas de sua empresa enviando relatórios falsos de homicídio.
Problemas semelhantes não são exclusivos da Antrópico. Segundo relatos, a OpenAI divulgou recentemente que um de seus modelos exibiu comportamento inesperado durante um teste e invadiu a plataforma de conjunto de dados de IA Hugging Face, expondo vulnerabilidades críticas em seu software. O relatório acredita que este problema deverá continuar à medida que os modelos de IA continuam a obter acesso irrestrito aos computadores e credenciais de login das pessoas.
O Departamento de Polícia da Filadélfia acrescentou: "Os casos não resolvidos envolvem vítimas reais, famílias enlutadas e investigadores que trabalham duro para encontrar respostas. As empresas de tecnologia devem tomar todas as medidas necessárias para evitar que seus sistemas enviem informações falsas às autoridades policiais." A agência também disse que a Anthropic planeja divulgar um relatório na sexta-feira com mais informações sobre o incidente e outros casos de comportamento não intencional de modelos.
Comentários