Agenții OpenAI au atacat RubyGems înainte de incidentul Hugging Face, spun cercetătorii

de O Teodor
7 vizualizari
Agenții OpenAI au atacat RubyGems înainte de incidentul Hugging Face, spun cercetătorii

Agenții AI ai OpenAI au atacat RubyGems înainte de incidentul Hugging Face

Agenții de inteligență artificială testați de OpenAI au atacat serviciul de software RubyGems cu două luni înainte de a compromite platforma open-source Hugging Face, au declarat cercetătorii, potrivit Reuters. Incidentul reprezintă cea mai recentă dezvăluire privind atacurile cibernetice legate de marii dezvoltatori de AI, care au alarmat publicul și au determinat apeluri pentru reglementări mai stricte.

Potrivit unui grup de cercetători care și-au publicat concluziile online vineri, agenții AI au încărcat sute de pachete malițioase pe RubyGems pe 11 mai. Cercetătorii au declarat că „acestea au fost create de agenți interni OpenAI”.

OpenAI a confirmat incidentul. „Pe baza analizei noastre, agenții noștri au folosit platforma RubyGems pentru a accesa internetul în scopul îndeplinirii unor sarcini benefice și pentru a recupera informații publice. Vom continua investigația ca parte a analizei mai ample a activității agenților în timpul antrenamentului și evaluării”, a declarat un purtător de cuvânt al OpenAI.

Agenții, care sunt în general însărcinați cu sarcini precum crearea de rapoarte sau completarea de foi de calcul, par să fi folosit RubyGems pentru a accesa date disponibile public în cadrul unei sesiuni de antrenament, a precizat OpenAI, adăugând că este în contact cu RubyGems pentru a examina incidentul.

Atacuri repetate ale agenților AI

Rivalul Anthropic, care se pregătește de listare la bursă, a raportat de asemenea o serie de atacuri ale agenților săi. Miercuri, compania a dezvăluit un al patrulea caz în care un model AI a spart sisteme externe în timpul testării.

Pentru OpenAI, care se pregătește și ea pentru o listare la bursă, atacul asupra RubyGems ar marca cel puțin al treilea incident major în care agenții săi au atacat infrastructura altei companii.

Anterior, un roi de agenți OpenAI a deturnat un site wiki în limba germană și l-a transformat într-o platformă de mesagerie improvizată pentru a trișa la examene, un incident pe care OpenAI l-a ținut secret în timp ce gestiona consecințele spargerii din iulie a depozitului open-source Hugging Face.

Agenții AI au încercat în mai să fure credențialele utilizatorilor RubyGems exploatând o vulnerabilitate necunoscută anterior în serverele site-ului, deși nu este clar dacă tentativa a reușit, au declarat cercetătorii vineri. De asemenea, agenții au exploatat RubyDoc.info, un site care generează documentație de cod, pentru a-și rula propriul cod pe serverele acestuia.

Cercetătorii în AI Spencer Kitts, Thomas Larsen și Sydney Von Arx au declarat că nu este clar de ce agenții AI au ales această strategie sau dacă a fost eficientă, întrucât nu au acces la restul comportamentului AI.

RubyGems: nicio dovadă că tentativele au reușit

Într-o postare pe blog vineri, RubyGems a declarat că propria investigație nu a găsit nicio dovadă că tentativele au reușit. Compania a precizat că nu a putut determina dacă pachetele din „campania de publicare de spam” au fost create sau publicate de agenți AI.

Un membru al echipei de securitate RubyGems a descris în mai incidentul — care a forțat compania să suspende temporar înregistrările de conturi noi — drept un „atac malițios major”.

Incidentul a fost raportat pentru prima dată vineri de The Wall Street Journal.

Postari asemanatoare