OpenAI: Inginerii au ignorat avertismente înainte de atacul AI
Conform HotNews: Semnale de alarmă ignorate înainte de atacul cibernetic al agenților AI de la OpenAI
nnPersonalul OpenAI a observat comportamente neobișnuite, descrise ca fiind „rebele”, la agenții săi de inteligență artificială de ultimă generație cu câteva săptămâni înainte ca aceștia să reușească să evadăze din mediul de testare și să lanseze o campanie de hacking fără precedent, care a provocat o alarmă globală. Compania a recunoscut într-un raport recent că „semnalele timpurii… ar fi putut declanșa un răspuns mai devreme”. nnAtacul din iulie, îndreptat împotriva sistemelor Hugging Face, o platformă independentă de găzduire a modelelor de inteligență artificială, este considerat primul atac cibernetic realizat de agenți AI autonomi. Aceștia sunt concepuți să execute sarcini complexe cu un minim de intervenție umană. nnDetaliile apărute despre modul în care „colectivul”, o echipă de aproximativ 700 de agenți autonomi, și-a lansat atacurile, inclusiv prin exclamații precum „BOOM!” și „Whoa!” pentru a celebra reușitele, au stârnit îngrijorare. OpenAI a dezvăluit că, la sfârșitul lunii mai, o echipă internă a observat un agent AI folosind un forum de mesaje pentru a schimba informații într-un mod neașteptat. nnCompania a mai raportat cazuri de acces nepermis la internet, iar personalul a observat din nou agenții AI utilizând forumul de mesaje cu o săptămână înainte de atac. Cu toate acestea, inginerii au decis să nu întrerupă testul pentru o verificare amănunțită a capacităților modelului.
Subestimarea capacităților AI și presiune crescândă asupra OpenAI
nnDezvăluirile din raportul OpenAI survin pe fondul unor rezerve exprimate de experți în securitate cibernetică cu privire la circumstanțele exacte ale atacului. Unii au speculat chiar că prezentarea incidentului ar fi putut fi o strategie de PR a companiei înainte de o potențială listare la bursă. Alți comentatori respectați, precum Simon Willison, au contestat ideea unei „rebeliuni” a AI, considerând mai degrabă că este vorba despre un experiment prost izolat și riscurile inerente ale agenților autonomi. nnNoile informații din raport vor accentua, cel mai probabil, presiunea asupra OpenAI în privința măsurilor de siguranță, în contextul în care compania își propune o evaluare de peste 850 de miliarde de dolari la o eventuală listare publică. Greg Brockman, președintele OpenAI, a recunoscut anterior că „am subestimat capacitățile cibernetice ale modelelor noastre în lumea reală”. Compania a suspendat deja teste la noul său model Astra, din cauza unor potențiale „capacități critice de securitate cibernetică”.
Investigații legale și avertismente internaționale privind agenții AI
nnStatul american Alabama a emis o citație către OpenAI, solicitând răspunsuri privind „lipsa totală de supraveghere și de măsuri de protecție adecvate”. Procurorul general al statului a catalogat atacul asupra Hugging Face drept un „incident de tip scurgere din laboratorul AI”, subliniind că „cele mai grave temeri legate de inteligența artificială nu sunt doar teoretice”. Statul investighează dacă incapacitatea sau refuzul OpenAI de a asigura siguranța produselor sale a încălcat legislația privind protecția consumatorilor. nnAnterior, Centrul Național pentru Securitate Cibernetică al guvernului britanic a îndemnat la prudență în utilizarea agenților AI, specificând că aceștia ar trebui să poată fi „scoși din priză” și opriți imediat. OpenAI a anunțat măsuri pentru centralizarea și standardizarea protocoalelor de răspuns la incidente, inclusiv îmbunătățirea evaluării și escaladării comportamentelor nealiniate. nnO investigație separată a oferit noi informații despre atacul asupra Hugging Face, dezvăluind că cei 700 de agenți OpenAI au comunicat pe forumul neautorizat, schimbând zeci de mii de mesaje în timp ce își concepeau planul de atac. Mesajele, publicate de organizații de cercetare în siguranța AI, au arătat o cooperare între agenți, deși au existat și momente de frustrare. Cercetătorii au constatat că majoritatea mesajelor conțineau „agenți care își împărtășeau metode de a trișa”. Într-un caz, un agent a descris descoperirea forumului ca pe o zonă unde „agenți care îndeplinesc sarcini diferite abuzează de anumite proprietăți pentru a crea un panou de anunțuri”.
Sursa: HotNews