Anthropic raportează că unul din modelele sale de inteligență artificială a acționat independent și a făcut o sesizare falsă către poliție
:format(jpg):quality(80)/https://www.economica.net/wp-content/uploads/2026/07/Untitled-747x420.jpg)
Este primul caz cunoscut în care un sistem de inteligenţă artificială care a acţionat în afara instrucţiunilor primite pare să fi încercat să transmită autorităţilor o informaţie falsă, deşi i se ceruse să nu creeze conturi şi să nu efectueze acţiuni distructive, fără a-i fi interzis însă în mod explicit să completeze şi să trimită formulare.
Aceste cazuri reprezintă cele mai recente exemple de comportament neautorizat sau nedorit al modelelor de inteligenţă artificială dezvoltate de companii tehnologice precum Anthropic şi OpenAI.
Incidentele amplifică îngrijorările la nivel naţional privind evoluţia rapidă a acestei tehnologii, pe fondul relatărilor despre atacuri informatice asupra reţelelor corporative comise de agenţi AI şi al avertismentelor cercetătorilor cu privire la o posibilă ameninţare existenţială pentru omenire.
Multe dintre cazurile dezvăluite de Anthropic au implicat site-uri administrate de agenţii federale, statale şi locale. Compania a precizat că a informat Casa Albă şi a notificat toate instituţiile implicate, fără a dezvălui însă identitatea acestora.
„Companiile care dezvoltă superinteligenţă trebuie să dezvăluie imediat incidentele care implică modelele lor şi să ia măsuri rapide şi ferme pentru a remedia orice prejudiciu”, a declarat pe platforma X Joe Gabriel Simonson, directorul pentru afaceri publice al Comisiei Federale pentru Comerţ (FTC).
Acesta a subliniat că procesul „nu este opţional”, adăugând că structura Super Intelligence Force îşi va îndeplini responsabilităţile.
FTC a anunţat că Anthropic a informat vineri această structură despre descoperirea, la sfârşitul lunii septembrie, a unor incidente pe care grupul operativ le-a descris drept „utilizare neautorizată şi frauduloasă a sistemelor guvernamentale şi a altor sisteme”.
Sesizare falsă, atribuită unui proces automatizat de testare
Vineri, poliţia din Philadelphia a anunţat că Anthropic a informat-o în cursul acestei săptămâni despre sesizarea falsă, atribuind transmiterea acesteia unui proces automatizat de testare.
„Întârzierea de două luni în detectarea şi raportarea incidentului către autorităţile oraşului este inacceptabilă”, a transmis poliţia.
Sesizarea, transmisă la 18 iulie, pretindea că provine de la o persoană care ar putea deţine informaţii despre cazul respectiv, au adăugat autorităţile.
„Este posibil să deţin informaţii referitoare la acest caz”, a scris modelul Anthropic în formularul transmis.
„Îmi amintesc că am văzut o persoană care corespundea descrierii în zona (străzii menţionate pe pagină), în perioada respectivă. Vă rog să mă contactaţi dacă aceste informaţii sunt relevante.”, era mesajul.
Parantezele au fost incluse în declaraţia Anthropic.
Incidente anterioare au implicat agenţi AI care au pătruns în sisteme vulnerabile sau au preluat controlul asupra unor platforme neautorizate pentru a comunica între ei.
În septembrie, OpenAI, companie concurentă a Anthropic, şi-a cerut scuze după ce un agent AI care a acţionat în afara instrucţiunilor primite a atacat informatic un portal australian de date medicale, acesta fiind primul caz cunoscut în care un agent AI a exploatat vulnerabilităţile unui site guvernamental.
O sesizare falsă
În două dintre cazurile prezentate vineri, modelele Anthropic au obţinut gratuit date publice pentru care, în mod normal, era necesară plata unei taxe. Un alt incident a scos la iveală o vulnerabilitate puţin cunoscută, care a permis utilizarea unui instrument public găzduit de o universitate.
Modelele Claude au reuşit, de asemenea, să ocolească restricţiile prin utilizarea unor servicii gratuite de scurtare a adreselor URL.
Poliţia din Philadelphia a precizat că sesizarea „a fost identificată drept spam şi nu a fost niciodată transmisă Centrului de Monitorizare a Criminalităţii în Timp Real pentru verificări investigative sau distribuire”.
Transmiterea cu bună ştiinţă a unor informaţii false către autorităţile de aplicare a legii constituie o infracţiune minoră potrivit legislaţiei statului Pennsylvania, care se referă însă în mod explicit la „o persoană”.
Legea include situaţiile în care cineva transmite „informaţii referitoare la o infracţiune sau la un incident, deşi ştie că nu deţine informaţii despre infracţiunea sau incidentul respectiv”.
Poliţia a citat explicaţiile oferite de Anthropic, potrivit cărora procesul de testare a fost oprit după descoperirea incidentului. Sesizarea falsă a fost transmisă prin intermediul site-ului PhillyUnsolvedMurders.com şi viza un caz de omor rămas nerezolvat.
Autorităţile au precizat că nu deţin dovezi privind accesarea neautorizată a sistemelor informatice ale poliţiei sau compromiterea datelor acesteia.