Anthropic e Claude: AI segnala minacce in Florida

Anthropic ha segnalato alla polizia le minacce attribuite a Carli Michelle Heller, una donna di 30 anni che avrebbe progettato una sparatoria contro locali delle forze dell’ordine. La segnalazione è arrivata dopo alcune conversazioni con Claude, il chatbot di intelligenza artificiale dell’azienda, e ha portato all’arresto della sospettata nella sua abitazione di Bonita Springs, in Florida.

Secondo le informazioni riportate dalla fonte, Heller aveva scritto a Claude il 26 settembre 2026 di voler aprire il fuoco contro strutture legate alle forze dell’ordine. Il giorno successivo avrebbe comunicato di essersi procurata una nuova arma da fuoco. A quel punto, i sistemi di sicurezza di Anthropic hanno inoltrato i contenuti a moderatori umani, che hanno attivato la procedura d’emergenza prevista dall’azienda.

Pubblicità

Claude ha intercettato le minacce e Anthropic ha avvisato la polizia

La procedura adottata da Anthropic consente di limitare la riservatezza delle conversazioni quando emergono elementi riconducibili a un rischio letale imminente. I messaggi della donna sono stati quindi sottoposti alla valutazione di moderatori umani, prima della comunicazione alle autorità.

La polizia è intervenuta poco dopo la segnalazione. Heller è stata fermata senza incidenti nella sua abitazione di Bonita Springs e incriminata per minaccia terroristica elettronica, secondo quanto riferito dalla fonte. Il caso mostra il ruolo dei sistemi di monitoraggio nei servizi di AI generativa, soprattutto quando una conversazione contiene riferimenti a violenza, armi e possibili obiettivi.

Anthropic avrebbe già trasmesso alla polizia tre segnalazioni di questo tipo dall’agosto 2026. L’azienda non tratta quindi ogni messaggio violento come una semplice provocazione: l’intervento viene attivato quando le conversazioni sembrano indicare un passaggio concreto dalla minaccia alla preparazione dell’atto.

La donna definiva Claude un “diario segreto”

Dopo l’arresto, Heller avrebbe spiegato agli investigatori di utilizzare Claude come un diario segreto. L’uso quotidiano dei chatbot porta molti utenti a descrivere pensieri personali, paure e intenzioni con un livello di confidenza simile a quello riservato a una persona di fiducia.

Il tono naturale delle risposte può però nascondere il funzionamento effettivo del servizio. Le conversazioni con un modello di intelligenza artificiale vengono gestite attraverso infrastrutture online e possono essere sottoposte a controlli, analisi automatizzate o revisione umana in presenza di violazioni delle regole e rischi per la sicurezza.

La sensazione di anonimato nasce anche dal fatto che l’interlocutore non è una persona fisica. ChatGPT, Claude, Gemini e gli altri sistemi di AI rispondono in modo conversazionale, ma non sono amici né consulenti vincolati da un segreto professionale. I contenuti inviati restano associati ai sistemi del fornitore secondo le modalità previste dai suoi servizi e dalle relative politiche.

Le regole di sicurezza dell’AI prevalgono nei casi di emergenza

La scelta di Anthropic riapre il confronto tra privacy degli utenti e prevenzione dei pericoli. La riservatezza può essere una componente importante dei servizi digitali, ma le aziende che sviluppano modelli GPT e piattaforme di AI stabiliscono eccezioni quando ritengono che una minaccia possa trasformarsi in un danno reale.

Nel caso di Claude, l’escalation ha previsto più fasi: il rilevamento automatico dei messaggi, il coinvolgimento dei moderatori e l’allerta alle forze dell’ordine. Questa sequenza serve a ridurre il rischio di segnalazioni basate soltanto su una frase ambigua, lasciando a personale umano la valutazione dei casi più gravi.

Il principio è diverso da quello di una sorveglianza generalizzata. I sistemi cercano indicatori specifici legati a minacce, pianificazione e disponibilità di strumenti per compiere un’aggressione. La decisione di contattare la polizia viene presa nell’ambito delle procedure interne dell’azienda, senza che l’utente possa considerare la chat uno spazio completamente privato.

La vicenda di Bonita Springs riguarda Claude e Anthropic, ma il tema coinvolge l’intero settore: da OpenAI a Google, passando per i servizi di ricerca AI come Perplexity e per i nuovi strumenti basati su modelli GPT. Le piattaforme devono bilanciare la libertà di espressione, la protezione dei dati e la necessità di intervenire quando una conversazione contiene segnali credibili di violenza.

Aggiungici su Google News Aggiungi MRW alle tue fonti preferite su Google! Aggungi su Google
Pubblicità
Massimiliano Bossi
Massimiliano Bossi
Stregato dalla rete sin dai tempi delle BBS e dei modem a 2.400 baud, ho avuto la fortuna di poter trasformare la mia passione in un lavoro (nonostante una Laurea in Giurisprudenza). Adoro scrivere codice e mi occupo quotidianamente di comunicazione, design e nuovi media digitali. Orgogliosamente "nerd" sono il fondatore di MRW.it (per il quale ho scritto centinaia di articoli) e di una nota Web-Agency (dove seguo in prima persona progetti digitali per numerosi clienti sia in Italia che all'estero).

Leggi anche...

ChatGPT e OpenAI: come fare il backup delle conversazioni

OpenAI permette agli utenti personali di esportare la cronologia...

Cybertech Europe 2026: AI e cyber security a Roma

Cybertech Europe 2026 porta a Roma il 6 ottobre...

Norvegia: Meta e Ray-Ban, stop agli occhiali AI

La Norvegia presenterà in Parlamento una legge per vietare...

TikTok sfida Facebook e Instagram con lo shopping AI

TikTok ha presentato il 6 ottobre 2026 il nuovo...

Giorgia Meloni deposita la voce contro i deepfake AI

Il 5 ottobre 2026 Giorgia Meloni ha depositato una...

Trump lancia la Super Intelligence Force sull’AI

Il presidente degli Stati Uniti Donald Trump ha annunciato...
Pubblicità