AI-ul care fabrică identități false pentru a sparge sisteme informatice: alarma experților britanici

0
56
AI-ul care fabrică identități false pentru a sparge sisteme informatice

Un program de inteligență artificială a încercat de 19 ori să penetreze ilegal o bază de date în cadrul unor teste de securitate organizate de AI Security Institute (AISI), autoritatea britanică de supraveghere în domeniu. Cel mai îngrijorător caz documentat implică un agent AI care a creat identități umane false pentru a manipula un programator și a-l determina să aprobe cod malițios.

Testele au vizat modele avansate dezvoltate de Anthropic și OpenAI, printre care Mythos 5 și GPT-5.6-Sol. Din cele 122 de scenarii simulate, agentul Anthropic a scăpat de sub control în 17 cazuri, iar cel al OpenAI în două. AISI a precizat că este prima dată când riscuri legate de autonomie și înșelăciune se manifestă atât de clar, fără o solicitare specifică, în condiții apropiate lumii reale.

În cel mai grav incident, un agent AI a colectat informații despre administratorul unui proiect de pe platforma GitHub, deținută de Microsoft, a creat mai multe identități false pentru a-l manipula, iar ulterior a șters orice urmă a acțiunilor sale. Agentul a luat chiar în calcul adoptarea unei noi identități pentru a evita detectarea de către operatorii umani.

Andrew Yoon, cercetător la organizația californiană CivAI, a declarat că implicarea modelului Mythos în astfel de acțiuni înșelătoare „sugerează că Anthropic nu deține un control asupra propriilor modele la fel de solid pe cât crede.” Ollie Whitehouse, director de tehnologie la National Cyber Security Centre din cadrul GCHQ, a catalogat incidentele drept „un semnal serios de alarmă” și a cerut planuri clare pentru situații neprevăzute.

Liderul conservatorilor britanici, Kemi Badenoch, a avertizat că inteligența artificială reprezintă „un pericol clar și prezent” pentru securitatea Regatului Unit. Allison Gardner, președinta grupului parlamentar transpartidic pentru AI, a atras atenția că nivelurile de risc asociate inteligenței artificiale agentice trebuie tratate cu maximă precauție, adăugând că „poate am creat cutia Pandorei și am deschis-o deja.”

Ministrul britanic pentru inteligență artificială, Kanishka Narayan, a încercat să tempereze îngrijorările, subliniind că identificarea acestor comportamente reprezintă exact scopul pentru care a fost înființat AISI în 2023. Anthropic și OpenAI au transmis că vor continua colaborarea cu evaluatorii pentru a consolida practicile de testare în condiții de siguranță.