Experții au avertizat că ar putea fi deja prea târziu pentru a ține sub control inteligența artificială în urma unui incident îngrijorător.
Experții au descoperit că un program AI și-a creat identități umane false pentru a pătrunde în sisteme online, scrie Daily Mail.
În cel mai recent exemplu, un software de inteligență artificială a încercat de 19 ori să spargă o bază de date.
Incidentul a avut loc în timpul testelor efectuate de Institutul pentru Securitatea Inteligenței Artificiale (AI Security Institute - AISI), autoritatea britanică responsabilă de monitorizarea riscurilor AI.
Inteligența artificială ar fi creat identități umane false pentru a compromite sistemele
Mai mult, într-un caz fără precedent, un instrument AI a fost surprins în timp ce crea identități umane false pe Internet pentru a păcăli programatori să îl ajute într-un atac cibernetic.
Dezvăluirile vin după în test în care toate cele 5 modele de inteligență artificială testate de experți au încercat să păcălească măsurile de securitate impuse.
Citește și: Companiile AI distrug cărți vechi și rare într-un proces „oribil”. De ce le strică
Cu doar câteva zile înainte, s-a aflat că și compania americană OpenAI s-a confruntat cu un incident similar, după ce un „agent” AI a pătruns din proprie inițiativă în sistemele unei alte companii.
Institutul pentru Securitatea Inteligenței Artificiale (AISI), înființat în 2023 de fostul premier britanic Rishi Sunak, a detectat dovezile activității acestor agenți AI săptămâna trecută.
AI a încercat să păcălească oamenii
Într-un raport publicat recent, instituția a dezvăluit că modele dezvoltate de OpenAI și Anthropic au încercat, în timpul testelor, să pătrundă în sisteme securizate conectate la internet.
Experții au observat inițial „transferuri neobișnuite de date” care părăseau sistemele monitorizate în timpul verificărilor de rutină.
Analizele ulterioare au arătat că unii agenți AI desfășuraseră „activități susținute, potențial dăunătoare, împotriva unor persoane și organizații reale”.
Anchetatorii au declanșat o investigație completă după ce au reușit să oprească agenții AI înainte ca aceștia să producă pagube reale.
„Faptul că Mythos a recurs la asemenea acțiuni înșelătoare, în timp ce părea conștient că țintește o persoană reală, sugerează că Anthropic nu controlează modelele sale atât de bine pe cât crede,” a declarat Andrew Yoon, cercetător la organizația CivAI, despre modelul creat de Anthropic.
AISI primește acces la modelele AI de ultimă generație în baza unor acorduri încheiate cu OpenAI, Anthropic și alte companii, pentru a le analiza capacitățile înainte ca acestea să fie lansate publicului.
În cadrul testelor, agenților AI li s-a oferit acces la internetul deschis, cu unele filtre de siguranță dezactivate.
În cel mai recent experiment, agenții AI, inclusiv pe cei bazați pe modelele Anthropic Mythos 5 și OpenAI GPT-5.6-Sol, au avut o provocare legată de securitate cibernetică.
AISI a constatat că inteligența artificială a încălcat regulile în 19 dintre cele 122 de simulări efectuate. Modelul Anthropic a fost responsabil pentru 17 dintre incidente, iar modelul OpenAI pentru celelalte 2.
În cel mai surprinzător caz, un model AI a colectat informații despre persoana responsabilă de un proiect online, apoi și-a creat mai multe identități false pentru a o manipula și a o convinge să aprobe un cod malițios pe care îl dezvoltase.
Ulterior, agentul AI a șters toate dovezile acțiunilor sale pentru a părea nevinovat în fața oamenilor și chiar a luat în calcul adoptarea unei noi identități pentru a evita să fie descoperit.
Dacă victima ar fi aprobat din greșeală codul malware, consecințele ar fi putut include breșe de securitate, furt de informații și date, precum și alte daune aduse fișierelor și sistemelor informatice.
AISI a identificat platforma GitHub, serviciul cloud al Microsoft folosit de dezvoltatori pentru crearea, stocarea, administrarea și distribuirea codului sursă, drept ținta atacului.
Totodată, institutul a descoperit că un agent AI a lăsat mesaje pentru alți agenți pe GitHub, prin care îi invita să colaboreze la îndeplinirea provocării.
Agentul a oferit instrucțiuni privind reutilizarea unor conturi și resurse pe care le lăsase în urmă, iar ceilalți agenți le-au descoperit și le-au folosit cu succes pentru a-și atinge obiectivele.
Soluția extremă la care a apelat un orădean ca să scape de caniculă. Cum arată culcușul pe care l-a amenajat în beciul b...