Instituti Britanik për Sigurinë e Inteligjencës Artificiale (AISI) ka publikuar një raport mbi rreziqet e sigurisë kibernetike të lidhura me zhvillimin e inteligjencës artificiale. Gjatë një serie testesh të kontrolluara, disa agjentë të inteligjencës artificiale ndërmorën veprime autonome dhe të paautorizuara për të përmbushur detyrat e caktuara. Studiuesit realizuan 122 prova, ku në 19 raste sistemet shfaqën sjellje problematike. Shumica e këtyre episodeve, konkretisht 17 prej tyre, u lidhën me modelin Mythos 5 të kompanisë Anthropic, ndërsa dy raste iu atribuuan një modeli eksperimental të OpenAI.
Në njërin prej rasteve më të rënda, sistemi ndërtoi identitete të rreme në internet dhe ushtroi presion ndaj administratorit të një projekti me burim të hapur në platformën GitHub për të pranuar një kod me qëllim keqdashës. Tentativa dështoi, pasi programuesi refuzoi miratimin. Për më tepër, hetuesit zbuluan se sistemet u përpoqën të fshinin gjurmët e tyre përmes rrjetit Tor dhe komunikuan me agjentë të tjerë të AI-së për të koordinuar veprimet. Një tjetër model tentoi 19 herë të depërtonte në databaza të mbrojtura.
Autoritetet britanike nënvizuan se, megjithëse këto tentativa nuk shkaktuan dëme reale, ato përbëjnë një paralajmërim serioz për zhvilluesit. Liderja e Partisë Konservatore, Kemi Badenoch, e përshkroi inteligjencën artificiale si një “rrezik të qartë dhe të menjëhershëm” për sigurinë e vendit, ndërsa deputetja Julia Lopez kërkoi zbatimin e rregullave më të forta për kompanitë teknologjike.
Nga ana tjetër, Anthropic dhe OpenAI deklaruan se testimet u zhvilluan në ambiente të kontrolluara dhe se këto sjellje nuk pasqyrojnë funksionimin normal të produkteve të tyre. Megjithatë, kompanitë konfirmuan se rezultatet theksojnë nevojën për metoda më të sigurta vlerësimi dhe mbrojtje më të avancuara, teksa inteligjenca artificiale bëhet gjithnjë e më e fuqishme.