Cloude, modelul de Inteligență Artificială dezvoltat de Anthropic, a trimis poliției din Philadelphia un pont fals despre o crimă nerezolvată.
Poliția din Philadelphia a dezvăluit că modelul de Inteligență Artificială al Anthropic a transmis autorităților un pont fals despre o crimă nerezolvată, scrie Al Jazeera.
Potrivit Departamentului de Poliție din Philadelphia, informația falsă a fost transmisă în iulie prin intermediul PhillyUnsolvedMurders.com, un site web public unde oamenii pot partaja informații despre crime nerezolvate. Oamenii legii susțin că întârzierea de două luni a Anthropic în detectarea și raportarea incidentului este "inacceptabilă".
Ar fi primul incident de acest gen
Anthropic a menționat cazul într-un raport de vineri care detaliază manipularea nesancționată a site-urilor web guvernamentale de către modelele Claude.
Este primul caz cunoscut în care un model de Inteligență Artificială să fi comunicat autorităților o informație falsă, în ciuda instrucțiunilor de a nu crea conturi și de a nu trimite nimic distructiv.
Poliția din Philadelphia a declarat că pontul "a fost marcat ca spam și nu a fost niciodată transmis Centrului pentru Criminalitate în Timp Real pentru verificarea investigațiilor sau diseminare".
Departamentul a declarat că a dezvăluit incidentul înainte de raportul Anthropic "în interesul transparenței și responsabilității depline a guvernului".
Ce spune Anthropic
Anthropic a confirmat informația ca parte a unei serii de incidente care au implicat site-uri web administrate de agenții federale, statale și locale. Anthropic a declarat că a informat Casa Albă și a notificat toate agențiile implicate.
Referindu-se la informația transmisă poliției din Philadelphia, compania a declarat: "Am împărtășit această constatare departamentului pe 8 octombrie, imediat ce analiza noastră tehnică a fost finalizată".
Totodată, Anthropic a oferit mai multe detalii despre incident.
"Într-un caz, însărcinat cu generarea de exemple de interacțiuni cu site-uri web, Claude a trimis o informație inventată prin intermediul unui formular online al departamentului de poliție", a mai transmis Anthropic.
Compania a adăugat: "Din transcriere, se pare că Claude a produs doar conținut exemplificativ pentru sarcină, în loc să încerce să inducă în eroare pe cineva pentru a atinge un obiectiv".
"Cel mai grav incident din această vară"
Compania a comparat acest caz cu "cel mai grav incident din această vară", în care "raționamentul înșelător al lui Claude a fost susținut ore întregi și a susținut atacul continuu". Este vorba despre incidentul în care modelul său de Inteligență Artificială Claude a spart sistemele a trei organizații în timpul testelor care trebuiau să le țină izolate de Internet.
În septembrie, rivalul Anthropic, OpenAI, și-a cerut scuze pentru că un portal australian de date medicale a fost spart de către un agent AI necinstit, primul caz cunoscut de exploatare a unui site web guvernamental de către un agent de Inteligență Artificială. Un raport recent semnalează că agenți de Inteligență Artificială creați de OpenAI ar fi capabili să își șteargă urmele și activitatea desfășurată, ridicând noi semne de întrebare privind controlul asupra acestor sisteme.
Precizăm că și modelul de Inteligență Artificială al Google, Gemini, a accesat fără autorizație trei sisteme informatice externe, în cadrul unui test din luna mai.