Usuária do chatbot de IA foi presa após conversar com o agente e fazer ameaças ao xerife de um condado; Anthropic identificou as mensagens e denunciou a usuária
Na Flórida, a estadunidense Carli Michelle Heller foi presa após fazer ameaças online ao escritório do xerife do Condado de Lee. A ameaça digital, porém, não foi feita através das redes sociais. Ao conversar com o chatbot de IA Claude, Carli mencionou o ataque e, no dia seguinte, mencionou o fato de que havia adquirido uma arma. A conversa foi enviada para análise humana da empresa, que denunciou a mulher à polícia.
As mensagens foram identificadas pelos mecanismos automatizados de segurança da Anthropic e encaminhadas para análise humana. A equipe responsável comunicou as autoridades, que registraram a ocorrência. De acordo com o relatório policial, o sistema monitora conversas em busca de expressões e conteúdos potencialmente ameaçadores e pode submetê-los a revisão humana quando considerados graves.
Heller utilizava o Claude como uma espécie de diário para registrar pensamentos e conversar sobre assuntos pessoais, segundo o relato da ocorrência. A acusação, formalizada em 30 de setembro, tem como base o Estatuto da Flórida 836.10, que prevê punições para ameaças transmitidas por escrito ou eletronicamente envolvendo morte, violência, tiroteios em massa ou atos terroristas.
A Anthropic afirma em sua documentação que pode fornecer informações às autoridades em situações de emergência nas quais considere necessária a divulgação para evitar risco de morte ou ferimentos físicos graves. O episódio também evidencia que conversas com chatbots não estão sujeitas às mesmas regras de sigilo aplicadas a profissionais como psicólogos e advogados.
O monitoramento de conversas envolvendo possíveis crimes também ocorre em outras empresas de inteligência artificial. Em um caso recente, a OpenAI não acionou a polícia após identificar conversas sobre violência armada entre uma adolescente e o chatbot, e posteriormente foi processada após a ocorrência do crime. A diferença entre os episódios ocorre em meio a discussões sobre os critérios usados pelas plataformas para identificar e comunicar ameaças às autoridades.
Fonte: veja.abril.com.br