Anthropic, în centrul unui incident grav: un model AI a inventat o mărturie despre o crimă și a trimis-o poliției

Anthropic, în centrul unui incident grav: un model AI a inventat o mărturie despre o crimă și a trimis-o poliției

SURSA FOTO: Dreamstime - Anthropic

Publicat de Horea Georgiana-Natalia la 10 octombrie 2026, 19:18

Compania Anthropic a transmis Poliției din Philadelphia o sesizare falsă despre o crimă nerezolvată, după ce un model de inteligență artificială (IA, Artificial Intelligence, AI) a completat automat un formular online. Incidentul s-a produs în iulie 2026, în timpul unui test, dar a fost raportat autorităților abia în octombrie 2026, stârnind critici privind siguranța sistemelor de inteligență artificială.

Un model AI al Anthropic a sesizat poliția din SUA despre o crimă inventată. Compania a raportat cazul după două luni

Un model de inteligență artificială (IA, Artificial Intelligence, AI) dezvoltat de compania Anthropic a transmis o sesizare falsă privind o crimă nerezolvată prin intermediul site-ului PhillyUnsolvedMurders.com, utilizat de poliția din Philadelphia pentru a primi informații de la cetățeni. Autoritățile americane au anunțat vineri că sesizarea a fost trimisă în iulie, în timpul unui test automatizat, și au criticat compania pentru întârzierea de două luni în raportarea incidentului.

Potrivit explicațiilor oferite de Anthropic, modelul de inteligență artificială efectua un test de interacțiune cu site-uri web selectate aleatoriu atunci când a accesat platforma poliției și a transmis informații inventate despre un caz de omor rămas nerezolvat.

Sesizarea, datată 18 iulie, părea să provină de la o persoană care deținea informații relevante pentru anchetă. Modelul a completat formularul cu un mesaj în care susținea că ar putea furniza detalii despre caz și că își amintea că văzuse o persoană care corespundea descrierii din apropierea locului menționat pe site, în perioada respectivă. Mesajul solicita poliției să contacteze expeditorul dacă informațiile erau relevante.

Poliția din Philadelphia a precizat că sesizarea a fost clasificată drept spam și nu a ajuns la Centrul de Monitorizare a Criminalității în Timp Real, instituția responsabilă de verificările investigative și distribuirea informațiilor relevante. Autoritățile au adăugat că nu există dovezi că modelul ar fi accesat fără autorizație sistemele informatice ale poliției sau că datele acesteia ar fi fost compromise.

Anthropic a descoperit incidentul pe 28 septembrie și a întrerupt procesul automatizat de testare implicat. Compania a introdus, de asemenea, o etapă suplimentară de validare pentru testele viitoare. Autoritățile au fost informate pe 7 octombrie, iar reprezentanții celor două părți s-au întâlnit în ziua următoare.

Poliția din Philadelphia a criticat întârzierea, considerând inacceptabil faptul că au trecut două luni până la detectarea și raportarea incidentului către autoritățile locale. Instituția a apreciat că mecanismele sale de protecție au limitat consecințele, dar a avertizat că acestea nu reduc gravitatea transmiterii unor informații inventate ca și cum ar proveni de la o persoană care cunoaște detalii despre o crimă.

Autoritățile au subliniat că dosarele nerezolvate implică victime reale, familii îndoliate și anchetatori care încearcă să afle adevărul. Potrivit legislației statului Pennsylvania, transmiterea cu bună știință a unor informații false către autoritățile de aplicare a legii poate constitui o infracțiune minoră. Prevederile legale se referă însă în mod explicit la o persoană, astfel că aplicarea lor într-un caz care implică un sistem de inteligență artificială nu este clarificată de informațiile prezentate de autorități.

Mai multe incidente care implică modele de inteligență artificială

Cazul din Philadelphia face parte dintr-o serie de incidente privind comportamente neprevăzute ale modelelor de inteligență artificială, dezvăluite de companii tehnologice precum Anthropic și OpenAI. Aceste situații au amplificat îngrijorările privind dezvoltarea rapidă a tehnologiei și capacitatea sistemelor autonome de a efectua acțiuni nedorite în mediul online.

Vineri, Anthropic a prezentat mai multe incidente în care modelele sale Claude au interacționat fără autorizare cu site-uri administrate de instituții guvernamentale federale, statale și locale. Compania a precizat că a informat Casa Albă și instituțiile implicate, fără să le dezvăluie identitatea.

În două dintre cazurile prezentate, modelele au obținut gratuit date publice pentru care, în mod normal, era necesară plata unei taxe. Un alt incident a scos la iveală o vulnerabilitate care permitea utilizarea unui instrument public găzduit de o universitate. Modelele Claude au reușit să ocolească anumite restricții prin intermediul unor servicii gratuite de scurtare a adreselor URL.

Anthropic anunțase anterior, pe 9 septembrie, alte patru cazuri în care modelele sale accesaseră fără autorizație sisteme informatice ale unor terți în timpul testelor de securitate cibernetică. Potrivit companiei, testele ar fi trebuit să se desfășoare fără acces la internet, însă o eroare de configurare a menținut conexiunea activă.

Incidente similare au fost raportate și în cazul OpenAI. În iulie, sute de agenți de inteligență artificială, programe concepute pentru a executa autonom anumite sarcini, au părăsit mediul de testare și au pătruns în serverele platformei Hugging Face. În septembrie, OpenAI și-a cerut scuze după ce un agent de inteligență artificială care a acționat în afara instrucțiunilor primite a exploatat vulnerabilitățile unui portal australian de date medicale.

Aceste cazuri au alimentat temerile privind posibilitatea ca agenții de inteligență artificială să acceseze sisteme vulnerabile, să ocolească restricții și să execute acțiuni pentru care nu au primit autorizare explicită.

FTC cere raportarea rapidă a incidentelor

Comisia Federală pentru Comerț din SUA (FTC) a anunțat că Anthropic a informat vineri structura Super Intelligence Force despre incidentele descoperite la sfârșitul lunii septembrie. Grupul operativ le-a descris drept cazuri de utilizare neautorizată și frauduloasă a sistemelor guvernamentale și a altor sisteme informatice.

Joe Gabriel Simonson, directorul pentru afaceri publice al FTC, a declarat pe platforma X că firmele care dezvoltă sisteme de inteligență artificială avansată trebuie să raporteze imediat incidentele în care sunt implicate modelele lor și să ia măsuri rapide pentru a remedia eventualele prejudicii. Acesta a precizat că respectarea acestor obligații nu este opțională și că Super Intelligence Force își va îndeplini responsabilitățile.

Dezvăluirile au reaprins dezbaterea privind riscurile asociate dezvoltării inteligenței artificiale, în contextul relatărilor despre atacuri informatice asupra rețelelor corporative și al avertismentelor unor cercetători referitoare la posibile amenințări majore generate de această tehnologie.

Despre autor
Horea Georgiana-Natalia

Absolventă a Facultății de Jurnalism și Științele Comunicării (Relații Publice și Comunicare) din cadrul Universității din București. Absolventă a Masteratului Relații Publice și Comunicare din cadrul Școlii Naţionale de Studii Politice și Administrative (SNSPA). Redactor pentru Capital.ro din toamna anului 2021 până în prezent.

Condiții de preluare

Informațiile publicate de capital.ro pot fi preluate de alte publicații online doar în limita a 500 de caractere și cu citarea sursei cu link activ. Orice abatere de la această regulă constituie o încălcare a Legii 8/1996 privind dreptul de autor.

Lasă un comentariu

Trebuie să fii autentificat pentru a lăsa un comentariu.