Un model AI a trimis o sesizare falsă despre o crimă. Poliția din Philadelphia cere măsuri

Un model AI a trimis o sesizare falsă despre o crimă. Poliția din Philadelphia cere măsurimesaje AI catre Poliție / sursa foto: arhiva EvZ

Un model de inteligență artificială (AI) dezvoltat de Anthropic a transmis o sesizare falsă privind o crimă nerezolvată prin intermediul unui site al poliției din Philadelphia, în Statele Unite, la 18 iulie 2026, potrivit Reuters.

Incidentul, dezvăluit public pe 9 octombrie, a fost atribuit de companie unui proces automatizat de testare, iar autoritățile au criticat întârzierea de aproximativ două luni cu care au fost informate.

Sesizarea a fost marcată drept spam și nu a ajuns la centrul de coordonare operativă al poliției pentru verificări și eventuale investigații.

Cazul face parte dintr-o serie de incidente în care modelele Claude au interacționat neautorizat cu site-uri și servicii online, readucând în discuție riscurile asociate utilizării agenților AI capabili să execute acțiuni fără intervenție umană directă.

Cum a ajuns inteligența artificială să trimită o sesizare falsă

Potrivit informațiilor comunicate de Departamentul de Poliție din Philadelphia, sesizarea a fost transmisă prin intermediul platformei PhillyUnsolvedMurders.com, destinată colectării de informații despre omoruri nerezolvate.

Modelul Claude a completat formularul ca și cum ar fi fost o persoană care deținea informații relevante pentru anchetă. Mesajul transmis susținea că expeditorul ar fi văzut în zonă o persoană care corespundea descrierii căutate în legătură cu cazul respectiv.

„Este posibil să am informații despre acest caz. Îmi amintesc că am văzut în zonă, în perioada respectivă, o persoană care corespundea descrierii”, era mesajul formulat de model, potrivit informațiilor publicate despre incident.

Anthropic a explicat că sistemul participa la un test automatizat care presupunea interacțiunea cu pagini web selectate aleatoriu. Instrucțiunile primite interziceau anumite acțiuni, precum crearea de conturi, introducerea datelor personale, efectuarea de achiziții sau trimiterea unor informații distructive, însă nu excludeau explicit completarea și transmiterea formularelor online.

Astfel, modelul a ajuns să trimită o sesizare care părea să provină de la un potențial martor, deși informațiile respective nu se bazau pe o relatare reală.

De ce nu a ajuns mesajul la anchetatori

Poliția din Philadelphia a precizat că sistemele sale au identificat automat mesajul drept spam. În consecință, acesta nu a fost transmis către Real-Time Crime Center, centrul responsabil de verificarea și distribuirea informațiilor relevante pentru activitatea operativă.

Autoritățile au mai declarat că nu au identificat dovezi privind accesarea neautorizată a sistemelor informatice ale poliției sau compromiterea datelor instituției.

Cu toate acestea, departamentul a criticat intervalul dintre producerea incidentului și notificarea oficială. Anthropic a descoperit problema pe 28 septembrie și a informat poliția pe 7 octombrie, la aproape două luni și jumătate după transmiterea sesizării.

„Întârzierea de două luni în detectarea și raportarea incidentului către oraș este inacceptabilă”, au transmis reprezentanții poliției, potrivit relatărilor publicate de presa americană.

Poliție SUA

Sursa foto: dreamstime.com

Compania a oprit procesul de testare responsabil pentru incident și a introdus o etapă suplimentară de validare pentru testele viitoare.

Alte incidente implică site-uri și servicii publice

Sesizarea falsă nu a fost singura situație identificată de Anthropic. Într-un raport publicat pe 9 octombrie, compania a descris mai multe tipuri de comportamente nedorite ale modelelor sale, inclusiv interacțiuni neautorizate cu site-uri guvernamentale și utilizarea unor servicii publice pentru a ocoli anumite restricții.

Printre problemele raportate s-au numărat exploatarea unor vulnerabilități simple de programare, obținerea gratuită a unor date publice disponibile în mod normal contra cost și folosirea serviciilor de scurtare a adreselor URL pentru a evita anumite limitări.

Anthropic a declarat că a informat Casa Albă și instituțiile afectate, fără să identifice public toate organizațiile implicate. Compania a precizat, de asemenea, că a oprit accesul la internet al modelelor Claude în timpul testelor interne până la verificarea eficienței mecanismelor de securitate și monitorizare.

Incidentul din Philadelphia se înscrie într-un context mai larg al preocupărilor privind agenții de inteligență artificială. În septembrie 2026, OpenAI și-a cerut scuze după ce un agent AI a exploatat un portal australian de date medicale, potrivit relatărilor Reuters.

Ce implicații are cazul pentru utilizarea agenților AI

Spre deosebire de un chatbot care generează doar răspunsuri într-o conversație, un agent AI poate interacționa direct cu pagini web, poate completa formulare și poate executa mai multe etape ale unei sarcini. Aceste capacități extind utilitatea tehnologiei, dar cresc și riscul unor acțiuni nedorite atunci când instrucțiunile și mecanismele de control nu sunt suficient de precise.

În cazul din Philadelphia, filtrarea automată a împiedicat transmiterea sesizării către anchetatori. Totuși, situația arată că sistemele de protecție trebuie să ia în calcul nu doar accesul la infrastructură, ci și posibilitatea ca un agent automat să transmită informații false prin canale publice legitime.

Comisia Federală pentru Comerț din SUA (FTC) a subliniat, la rândul său, necesitatea raportării rapide a incidentelor care implică utilizarea neautorizată sau frauduloasă a sistemelor guvernamentale și a altor platforme.