Departamentul de Poliție din Philadelphia a precizat că informația, transmisă pe 18 iulie, a fost „marcată drept spam” și nu a fost trimisă mai departe pentru investigații. Cu toate acestea, poliția a criticat compania de tehnologie pentru faptul că a avut nevoie de peste două luni pentru a detecta incidentul și a-l raporta, scrie BBC.

Într-un comunicat, poliția a explicat că pontul fals a fost transmis prin intermediul unui site public, unde cetățenii pot furniza informații despre crime rămase nerezolvate.

Agentul AI a scris că ar putea deține informații despre un anumit caz și a susținut că a văzut „o persoană care corespundea descrierii”.

Se crede că acesta este primul caz în care un agent AI a transmis autorităților informații inventate. Incidentul este însă doar cel mai recent dintr-o serie de situații în care sisteme de inteligență artificială au acționat în mod necontrolat, inclusiv prin piratarea unor sisteme informatice sau preluarea controlului asupra unor platforme.

Agentul AI efectua un test și a trimis informația falsă fără autorizare

Citând explicațiile oferite de Anthropic, Departamentul de Poliție din Philadelphia a precizat că agentul AI executa un test care presupunea interacțiuni cu site-uri selectate aleatoriu, în momentul în care a transmis pontul fals.

Anthropic a descoperit incidentul pe 28 septembrie, la mai bine de două luni după trimiterea mesajului, și a oprit procesul automat de testare care provocase situația, potrivit poliției.

Autoritățile au fost însă informate abia nouă zile mai târziu, pe 7 octombrie.

„Compania trebuie să își consolideze măsurile de protecție pentru a preveni incidente similare care ar putea afecta sistemele orașului fără știrea autorităților”, a transmis Poliția din Philadelphia într-un comunicat pentru presa locală.

„Întârzierea de două luni în detectarea și raportarea incidentului către autoritățile orașului este inacceptabilă.”

Departamentul de Poliție a adăugat că nu există indicii privind compromiterea vreunuia dintre sistemele sale informatice și că mecanismele de protecție au împiedicat informația falsă să treacă de filtrul de spam.

Totuși, aceste măsuri de securitate „nu diminuează gravitatea faptului că un sistem de inteligență artificială a prezentat informații fabricate ca și cum ar proveni de la o persoană care deținea informații despre o crimă”, se arată în comunicatul poliției.

Anthropic recunoaște mai multe acțiuni neprevăzute ale agenților săi AI

Anthropic a publicat săptămâna aceasta un raport în care prezintă mai multe tipuri de acțiuni „neintenționate” efectuate de agenții săi de inteligență artificială.

Potrivit companiei, printre organizațiile afectate s-au numărat și mai multe instituții guvernamentale americane, inclusiv Casa Albă.

Departamentul de Stat al SUA a transmis că un agent AI a completat și trimis 20 de cereri de viză prin intermediul unui formular disponibil pe site-ul instituției. Cererile erau însă incomplete și nu au fost procesate, potrivit relatărilor din presă.

Președintele Donald Trump a anunțat recent înființarea unui grup de lucru dedicat inteligenței artificiale, care, potrivit acestuia, va coordona dialogul dintre guvern și toate părțile implicate, inclusiv companiile de AI, consumatorii și organizațiile religioase.

Incidente similare au implicat și agenți AI dezvoltați de OpenAI

La începutul acestui an, un agent AI dezvoltat de compania rivală OpenAI a piratat un site guvernamental australian și a accesat date private din cadrul Medicare, sistemul public universal de asigurări de sănătate din Australia.

Într-un alt incident, peste 1.200 de agenți AI ai OpenAI au început să comunice în mod neașteptat între ei, iar un grup numeros dintre aceștia s-a coordonat pentru a pirata platforma de inteligență artificială Hugging Face.