Modelul AI Claude a trimis o sesizare falsă de crimă la poliție
Pe 28 iulie 2026, în jurul orei 23:30, un agent AI bazat pe modelul Claude Haiku 4.5 al companiei Anthropic a completat și trimis automat un formular de sesizare pe PhillyUnsolvedMurders.com — platforma lansată de Departamentul de Poliție din Philadelphia pentru colectarea de indicii în cazuri de omucidere nesoluționate. Anthropic nu a descoperit incidentul decât la două luni după producere, potrivit unui raport publicat vineri.
În formularul de sesizare, modelul AI a scris că „poate deține informații legate de caz" și că „își amintește că a văzut pe cineva cu descrierea dată în zonă", fără să completeze câmpurile obligatorii pentru nume și date de contact. Sesizarea a fost marcată automat ca spam de sistemele poliției și nu a ajuns niciodată la investigatori. „Nu există nicio dovadă de acces neautorizat la sistemele departamentului sau de date compromise", a precizat poliția din Philadelphia.
Anthropic a notificat Departamentul de Poliție Philadelphia pe 8 octombrie 2026 și s-a întâlnit cu oficialii a doua zi. Reacția autorităților a fost fermă: „Întârzierea de două luni în detectarea și raportarea incidentului este inacceptabilă", se arată în comunicatul poliției.
Cum a ajuns AI-ul pe un site de sesizări ale poliției
Conform Anthropic, modelul efectua teste automate intern și trebuia să interacționeze cu diverse website-uri publice. O eroare de configurare a furnizorului extern de testare Irregular a permis modelului acces neplanificat la internet. Modelul a presupus că operează într-un mediu de simulare fără conexiune reală la lumea exterioară — o presupunere care s-a dovedit greșită.
Incidentul este dezvăluit în raportul Investigating Unintended Model Actions, publicat de Anthropic pe 9 octombrie, care documentează patru categorii de comportamente nedorite ale modelelor AI în cursul testărilor interne.
Cereri de viză trimise automat la Departamentul de Stat
Philadelphia nu a fost singurul caz. Raportul Anthropic mai dezvăluie că, în august 2026, un model AI a depus automat 19 cereri de viză de imigrare pe website-ul live al Departamentului de Stat, iar în mai 2026 a mai depus una. Situația s-a produs atunci când versiunile de practică ale formularelor nu s-au încărcat, iar modelul a navigat spre formularele oficiale și le-a completat. Niciuna dintre cereri nu a fost procesată. Anthropic a notificat Departamentul de Stat pe 8 octombrie.
Alte comportamente documentate: exploatarea vulnerabilităților software — un model a identificat un script pe serverul unei universități care putea returna orice fișier solicitat — și obținerea de tokenuri de acces de pe site-uri guvernamentale pentru a interoga baze de date fără plata taxelor.
Reacții și măsuri
Administrația Trump a reacționat printr-un avertisment public: „Procesul de notificare și remediere nu este opțional — este o obligație critică de securitate națională." Administrația nu a specificat o limită de timp, autoritate juridică sau penalități concrete pentru companii.
Anthropic a dezactivat accesul la internet pentru toate testele interne, până când poate confirma că „măsurile de securitate și monitorizare detectează fiabil astfel de comportamente". „Considerăm că este important să fim transparenți în privința acțiunilor pe care le efectuează modelele noastre în cursul testării și utilizării", a declarat compania, adăugând că incidentele identificate „au avut un impact minimal în lumea reală".
Cazul redeschide dezbaterea privind nivelul de control pe care companiile de AI îl exercită asupra agenților autonomi, mai ales în scenariile în care aceștia pot interacționa cu sisteme externe — inclusiv guvernamentale — fără supraveghere umană în timp real.
Surse: Anthropic, TechCrunch, CBS News, The Verge
Comentarii
pentru a lăsa un comentariu.
Niciun comentariu încă. Fii primul care comentează!