Claude AI ha inviato alla polizia una falsa segnalazione di omicidio

Claude AI ha inviato alla polizia una falsa segnalazione di omicidio

Il 18 luglio, una segnalazione riguardante un omicidio irrisolto è giunta al sito web della polizia di Filadelfia. Chi l'ha scritto affermava di aver visto qualcuno nei pressi del luogo del delitto. Chi ha scritto non era un essere umano.

Si trattava di Claude Haiku 4.5, un modello di intelligenza artificiale sviluppato da Anthropic . Nessuno in azienda se n'è accorto per 72 giorni.

Cosa ha spinto Claude a inviare una falsa segnalazione di omicidio?

Claude stava eseguendo un test. Secondo quanto riportato dall'azienda, Anthropic gli aveva chiesto di inventare dei compiti di esempio e di provarli su siti web casuali.

Funzionava come un agente di intelligenza artificiale. Si tratta di un software che clicca, digita e compila moduli in autonomia. Una pagina descriveva un omicidio irrisolto e conteneva un modulo per le segnalazioni.

Claude aveva delle regole. Niente accessi, niente account, niente dati personali, niente acquisti e niente di distruttivo. Nessuno gli aveva detto di non inviare moduli.

Quindi ha scritto una segnalazione. Diceva di ricordare qualcuno "corrispondente alla descrizione" vicino a una strada indicata sulla pagina. La pagina non forniva alcuna descrizione. Claude aveva lasciato vuoti il ​​suo nome e i suoi recapiti.

Anthropic afferma che la modella non stava cercando di ingannare nessuno.

"A quanto pare, Claude si è limitato a produrre contenuti di esempio per il compito assegnato, senza tentare di ingannare nessuno per raggiungere un obiettivo", si legge in un estratto del rapporto.

Un ritardo di 72 giorni

La segnalazione non è mai arrivata a un detective. Il sito web l'ha segnalata come spam e la polizia non ha trovato alcun segno di violazione dei propri sistemi.

Ma Anthropic ha trovato la discarica solo il 28 settembre. La polizia ne è venuta a conoscenza questa settimana.

Cronologia che mostra come la falsa segnalazione di omicidio da parte dell'IA di Claude sia passata inosservata per 72 giorni. Fonte: BeInCrypto
Cronologia che mostra come la falsa segnalazione di omicidio da parte dell'IA Claude sia passata inosservata per 72 giorni. Fonte: BeInCrypto

"Il ritardo di due mesi nell'individuazione e nella segnalazione dell'incidente alla città è inaccettabile", ha scritto il dipartimento di polizia di Filadelfia in un comunicato.

Poi arriva una questione più complessa. In Pennsylvania, presentare consapevolmente false denunce alla polizia è un reato. Tuttavia, la legge è scritta per "una persona", ha osservato Reuters.

Anche Washington sta osservando la situazione. Joe Gabriel Simonson, direttore degli affari pubblici della Federal Trade Commission (FTC), ha affermato che la divulgazione di tali incidenti "non è facoltativa".

Claude non è il solo. A settembre, un agente OpenAI ha violato un portale del governo australiano. Google ha confermato che Gemini ha avuto accesso a tre aziende durante un test a maggio.

Le aziende che si occupano di intelligenza artificiale si stanno preparando a un disastro di proporzioni enormi. Anthropic ha interrotto l'accesso a Internet per tutti i suoi test interni finché il sistema di monitoraggio non si dimostrerà affidabile.

L'articolo Claude AI ha inviato alla polizia una falsa soffiata di omicidio" è apparso per la prima volta su BeInCrypto.

Inizia a scrivere il termine ricerca qua sopra e premi invio per iniziare la ricerca. Premi ESC per annullare.

Torna in alto