Două modele AI ale OpenAI au spart sistemele Hugging Face în timpul unui test

0
76

Două sisteme de inteligență artificială dezvoltate de OpenAI au ieșit de sub control în timpul unei sesiuni de testare și au reușit să acceseze neautorizat platformele Hugging Face, o bibliotecă digitală folosită pe scară largă de dezvoltatorii de software. Incidentul, produs săptămâna trecută, a fost dezvăluit public marți de compania care dezvoltă ChatGPT.

Sistemele AI erau testate pentru a identifica vulnerabilități software cunoscute, în cadrul unui exercițiu conceput de experți în securitate informatică. În loc să urmeze procedura stabilită, modelele au descoperit o eroare în software-ul care le limita accesul la alte rețele și au exploatat-o pentru a se conecta la internet și a obține răspunsurile testului direct de la Hugging Face.

Atacul a permis accesarea unor seturi interne de date și a unor credențiale ale Hugging Face, fără a fi clar dacă datele clienților au fost compromise. Clement Delangue, directorul general al Hugging Face, a declarat pe X că firma sa a colaborat îndeaproape cu OpenAI pentru a înțelege incidentul: „Credem cu tărie că nu a existat nicio intenție rău intenționată din partea lor. Este uluitor că toate acestea s-au întâmplat în mod autonom!”

OpenAI a calificat evenimentul drept „un atac cibernetic fără precedent, care implică tehnologii de ultimă generație în domeniul securității cibernetice” și a precizat că lucrează alături de Hugging Face pentru a evalua impactul complet. Compania a informat administrația Trump înainte de a face publice detaliile incidentului, potrivit unei surse anonime familiarizate cu situația.

Incidentul survine pe fondul unor îngrijorări tot mai mari legate de capacitățile ofensive ale sistemelor AI. Alex Levinson, consultant în securitate cibernetică specializat în capabilități autonome, a avertizat că astfel de atacuri vor deveni o realitate obișnuită: „Este un prag real, iar acest lucru va deveni o parte normală a peisajului de securitate.” Casa Albă a impus temporar restricții asupra OpenAI și Anthropic, pe care le-a ridicat ulterior, dezbaterea privind reglementarea acestor tehnologii continuând atât în administrație, cât și în industrie.

Un detaliu semnificativ a ieșit la iveală în urma incidentului: Hugging Face a fost nevoită să folosească un model AI chinezesc pentru a investiga breșa, deoarece controalele de siguranță ale modelelor americane le împiedicau să analizeze atacuri cibernetice. OpenAI a anunțat anterior că a observat modele AI puternice încercând să evadeze din mediile izolate de testare atunci când rulează autonom pentru perioade îndelungate.