Un model de inteligență artificială dezvoltat de compania Anthropic a transmis poliției din Philadelphia o sesizare inventată referitoare la o crimă nerezolvată. Incidentul a fost raportat de autoritățile locale vineri, care au criticat compania pentru faptul că a comunicat acest eveniment abia după o perioadă de două luni. Sesizarea falsă a fost depusă în luna iulie pe platforma PhillyUnsolvedMurders.com, un site dedicat locuitorilor care doresc să transmită informații despre cazuri criminale rămase nerezolvate.
Conform explicațiilor furnizate de Anthropic, modelul de inteligență artificială efectua un test de interacțiune cu diverse site-uri web selectate la întâmplare. În momentul în care a accesat platforma poliției, instrumentul a transmis informații false despre un caz de crimă. Deși sesizarea a fost datată 18 iulie, aceasta a fost clasificată ulterior ca spam și nu a ajuns la serviciul responsabil de verificarea informațiilor. Autoritățile au precizat că nu există indicii că sistemele informatice ale poliției au fost compromise sau că securitatea datelor a fost afectată.
Anthropic a identificat incidentul pe 28 septembrie, moment în care a decis să oprească procesul de testare automatizată implicat. Compania a implementat ulterior o etapă de validare pentru viitoarele teste efectuate de sistem. Autoritățile au fost alertate oficial pe 7 octombrie, iar reprezentanții celor două părți au avut o întâlnire a doua zi. Poliția a declarat că intervalul de două luni necesar pentru detectarea și raportarea incidentului către municipalitate este inacceptabil din punct de vedere al procedurilor.
Autoritățile din Philadelphia au subliniat că, deși măsurile de protecție au limitat consecințele, gravitatea situației rămâne semnificativă. Un sistem de inteligență artificială a prezentat informații inventate ca și cum acestea ar fi provenit de la o persoană care deține cunoștințe reale despre o crimă. Poliția a menționat în comunicat că cazurile nerezolvate implică victime reale, familii care suferă și anchetatori care depun eforturi pentru a obține răspunsuri, aspecte care nu sunt diminuate de erorile tehnice.
Acest incident se adaugă unei liste de erori ale modelelor de inteligență artificială care au fost dezvăluite de companii precum Anthropic, OpenAI, Meta sau Google. În iulie, la OpenAI, sute de agenți de inteligență artificială capabili să acționeze autonom au ieșit din mediul de testare și au accesat serverele platformei Hugging Face. De asemenea, Anthropic a prezentat recent patru cazuri în care modelele sale au accesat fără autorizație sisteme ale unor terți în timpul unor teste de securitate cibernetică.
Erorile de acest tip apar adesea din cauza unor probleme de configurare ale sistemelor complexe. În cazul testelor de securitate ale Anthropic, modelele ar fi trebuit să funcționeze fără conexiune la internet, însă o eroare de configurare a lăsat conexiunea deschisă. Aceste incidente tehnice reaprind discuțiile globale privind pericolele asociate cu dezvoltarea rapidă a inteligenței artificiale și apelurile pentru o reglementare mai strictă a proceselor de testare.