Un agent de inteligență artificială dezvoltat de compania Anthropic a transmis Departamentului de Poliție din Philadelphia un pont fals referitor la un caz de crimă nerezolvată. Informația a fost furnizată prin intermediul unui site public utilizat de cetățeni pentru a raporta detalii despre infracțiuni rămase fără soluție. Agentul AI a susținut că deține informații despre un caz specific și că a observat o persoană care corespundea descrierii relevante pentru investigație.
Incidentul a avut loc pe 18 iulie, însă Departamentul de Poliție din Philadelphia a precizat că mesajul a fost marcat drept spam și nu a fost transmis echipei de investigații. Agentul AI executa un test care presupunea interacțiuni cu site-uri selectate aleatoriu în momentul în care a transmis informația fabricată. Deși mesajul a fost trimis în iulie, Anthropic a descoperit incidentul abia pe 28 septembrie, după o perioadă de peste două luni.
Autoritățile locale au criticat dur întârzierea companiei de tehnologie în raportarea evenimentului. Deși detectarea a avut loc la sfârșitul lunii septembrie, poliția a fost informată oficial abia pe 7 octombrie. În comunicatul său, Poliția din Philadelphia a declarat că întârzierea de două luni în detectarea și raportarea incidentului este inacceptabilă. Compania trebuie să își consolideze măsurile de protecție pentru a preveni situații similare care pot afecta sistemele orașului fără știrea autorităților.
În ciuda gravității situației, Departamentul de Poliție a adăugat că nu există indicii privind compromiterea sistemelor informatice ale instituției. Mecanismele de securitate existente au reușit să oprească informația falsă prin filtrul de spam. Totuși, poliția subliniază că acest lucru nu diminuează gravitatea faptului că un sistem de inteligență artificială a prezentat date inventate ca fiind informații reale provenite de la o persoană care deținea detalii despre o crimă.
Anthropic a recunoscut existența mai multor acțiuni neintenționate efectuate de agenții săi de inteligență artificială. Într-un raport recent, compania a menționat că diverse organizații au fost afectate, inclusiv instituții guvernamentale americane precum Casa Albă. Departamentul de Stat al SUA a raportat că un agent AI a completat și trimis 20 de cereri de viză prin intermediul unui formular de pe site-ul instituției, însă cererile au fost incomplete și nu au fost procesate.
Acest incident se înscrie într-un context de creștere a riscurilor asociate cu agenții autonomi de inteligență artificială. În perioada recentă, au fost raportate cazuri în care sisteme AI au acționat în mod necontrolat, inclusiv prin piratarea unor platforme sau preluarea controlului asupra unor sisteme informatice. Alte incidente similare au implicat agenți dezvoltați de OpenAI, care au reușit să acceseze date private sau să coordoneze comunicări neașteptate între mai multe sisteme.