Acest caz se adaugă unei serii de erori ale modelelor de IA dezvăluite încă din vară de Anthropic, OpenAI, Meta sau Google, care au reaprins temerile privind pericolele IA și apelurile la încetinirea dezvoltării acesteia, potrivit News.ro.

Poliția din Philadelphia, din estul Statelor Unite, a precizat că această sesizare falsă a fost depusă în iulie pe PhillyUnsolvedMurders.com, un site unde locuitorii pot transmite informații despre crime nerezolvate.

Conform explicației companiei Anthropic, modelul efectua un test de interacțiune cu site-uri web alese la întâmplare atunci când a accesat această platformă și a transmis informații false despre un caz.

Poliția a explicat că a făcut public cazul înainte de publicarea, prevăzută pentru vineri, a unui raport al companiei Anthropic dedicat acestui incident și altor comportamente neprevăzute ale modelelor sale.

Solicitată de AFP, compania Anthropic nu a răspuns imediat.

Sesizarea falsă a fost clasificată ca spam de poliție

Potrivit poliției, sesizarea, datată 18 iulie, a fost clasificată ca spam și nu a ajuns niciodată la serviciul însărcinat cu verificarea acestor informații. Nimic nu indică faptul că instrumentul de IA ar fi pătruns în sistemele informatice ale poliției sau că securitatea datelor poliției ar fi fost compromisă, a adăugat aceasta.

Anthropic a descoperit incidentul pe 28 septembrie, a oprit procesul de testare automatizată în cauză și a adăugat o etapă de validare pentru testele sale viitoare.

Compania a alertat autoritățile pe 7 octombrie, iar cele două părți s-au întâlnit a doua zi. „Termenul de două luni pentru detectarea și semnalarea incidentului către municipalitate este inacceptabil”, a declarat poliția într-un comunicat.

Aceasta a considerat că măsurile sale de protecție au limitat consecințele, dar că ele „nu diminuează în niciun fel gravitatea faptului că un sistem IA prezintă informații inventate ca și cum ar proveni de la o persoană care are cunoștință despre o crimă”.

„Cazurile nerezolvate privesc victime reale, familii îndoliate și anchetatori care se străduiesc să obțină răspunsuri”, adaugă comunicatul.

Alte incidente înregistrate în timpul testelor modelelor de inteligență artificială

Pe 9 septembrie, Anthropic a prezentat în detaliu patru cazuri în care modelele sale au accesat fără autorizație sistemele unor terți în timpul unor teste de securitate cibernetică. Acestea ar fi trebuit să funcționeze fără acces la internet, dar o eroare de configurare a lăsat conexiunea deschisă, potrivit companiei.

În iulie, la rivalul său OpenAI, sute de agenți IA – programe capabile să acționeze în mod autonom – au ieșit din mediul lor de testare și au pătruns în serverele platformei Hugging Face.