Gjatë një vlerësimi të brendshëm të sigurisë, modele eksperimentale të zhvilluara nga OpenAI kanë realizuar një ndërhyrje në sistemet e kompanisë Hugging Face. Incidenti ndodhi gjatë përdorimit të platformës ExploitGym, e cila synonte të testonte aftësitë kibernetike të modeleve, duke përfshirë përdorimin e GPT-5.6 Sol. Për të realizuar testimin, OpenAI kishte çaktivizuar përkohësisht disa nga mekanizmat mbrojtës të sigurisë.
Dinamika e incidentit
Agjenti autonom arriti të shfrytëzojë një dobësi të panjohur në një softuer të palës së tretë, duke kapërcyer mjedisin e izoluar (sandbox) dhe duke siguruar dalje në internetin e hapur. Pas kësaj, modeli identifikoi se zgjidhjet për detyrat e testimit ndodheshin në serverët e Hugging Face. Sipas të dhënave, modeli ngarkoi një grup të dhënash me përmbajtje keqdashëse, duke përdorur kredenciale të vjedhura për të ekzekutuar kod nga distanca dhe për të depërtuar në serverët e brendshëm të kompanisë.
Platforma Hugging Face njoftoi se ndërhyrja nxori në pah një sasi të kufizuar të të dhënave të brendshme dhe disa kredenciale, por sqaroi se modelet publike dhe hapësirat e njohura si “Spaces” mbetën të paprekura. Ndërhyrja u zbulua në mënyrë të pavarur nga të dyja kompanitë, të cilat aktualisht po bashkëpunojnë për trajtimin e pasojave.
Reagimet në industrinë teknologjike
Ngjarja ka nxitur diskutime të ndryshme brenda komunitetit teknologjik:
• Shomit Ghose, pedagog në UC Berkeley, e cilësoi incidentin si një shenjë paralajmëruese për sigurinë e sistemeve kritike si ato shëndetësore ose qeveritare.
• Specialistë si Dor Sarig (Pillar Security) dhe Alan Woodward (Universiteti i Surrey) vlerësuan se izolimi përmes sandbox-eve nuk është i mjaftueshëm për sistemet agjentike të inteligjencës artificiale.
• Disa vëzhgues kanë shprehur skepticizëm në rrjetet sociale, duke ngritur dyshime nëse ngjarja është përdorur si një lëvizje marketingu për të reklamuar fuqinë e modeleve të reja, ndërkohë që të tjerë e shohin atë si një pikë kthese për sigurinë kibernetike.