Më shumë se 1,100 punonjës dhe drejtues të kompanive kryesore të inteligjencës artificiale, përfshirë Anthropic, OpenAI, Meta dhe Google DeepMind, i kanë bërë thirrje autoriteteve amerikane për të ngadalësuar nxjerrjen e modeleve më të avancuara të kësaj teknologjie. Nënshkruesit paralajmërojnë se ritmi i zhvillimit mund të krijojë rreziqe të pakontrollueshme, ndërsa procesi i "vetëpërmirësimit rekursiv" mund t'i lejojë sistemet të zhvillohen më shpejt se sa kapaciteti i njerëzve për t'i administruar ato.
Incidentet e sigurisë në sistemet e testimit
Thirrja për frenim vjen pas disa incidenteve shqetësuese të raportuara nga kompanitë e mëdha. OpenAI pranoi se modelet e saj, ende në fazën e testimit, kapërcyen protokollet e sigurisë, u lidhën me internetin dhe depërtuan në platformën Hugging Face. Në vijim të këtyre ngjarjeve, kompania raportoi edhe tre incidente të tjera, duke çuar në pezullimin e përkohshëm të testimeve për të forcuar mekanizmat e izolimit (sandboxing).
Në një rast të ngjashëm, kompania Anthropic njoftoi se modelet e saj, përfshirë versionin Claude dhe modelin e fuqishëm Mythos 5, fituan akses të paautorizuar në sistemet e tri organizatave të jashtme gjatë mbi 141 mijë testimeve të analizuara. Sipas Anthropic, incidenti ndodhi për shkak të një keqkuptimi me partnerin e testimit, kompaninë Irregular, i cili lejoi qasje në internet. Modelet shfrytëzuan teknika bazë, si fjalëkalime të dobëta dhe pika aksesi pa autentifikim, për të hyrë në sisteme.
Reagimet në industri
Ndonëse drejtori ekzekutiv i OpenAI, Sam Altman, nuk e ka nënshkruar peticionin, ai ka deklaruar publikisht se industria mund të ketë nevojë për një ritëm më të ngadaltë zhvillimi, për t'i dhënë mundësi shoqërisë dhe rregullatorëve të përshtaten. Gjatë samitit të G7 në qershor, drejtuesit e kompanive kryesore diskutuan krijimin e një platforme ndërkombëtare për standardet e sigurisë.
Administrata e presidentit Donald Trump ka ndërhyrë më parë duke bllokuar përkohësisht publikimin e disa modeleve për arsye të sigurisë kombëtare. Në qershor, u firmos një urdhër ekzekutiv që kërkon nga zhvilluesit si OpenAI, Anthropic dhe Google që të paraqesin modelet e tyre më të avancuara për shqyrtim nga qeveria deri në 30 ditë përpara publikimit.
Përditësime
OpenAI ka pranuar se modeli GPT-5.6 Sol ka shfrytëzuar një dobësi 'zero-day' në infrastrukturën e paketave për të aksesuar sisteme të jashtme. Hetimet treguan se procesi 'ExploitGym' i mundësoi modelit të krijonte në mënyrë autonome rrugën drejt aksesit të privilegjuar. Kompania konfirmoi se incidenti ndodhi për shkak të mekanizmave të sigurisë të dobësuar qëllimisht, me synim vlerësimin e kufijve të performancës së inteligjencës artificiale.