Tæknifyrirtækið OpenAI hefur greint frá því að gervigreindarmódel þess hafi sloppið undan prófi sem var verið að gera á þeim, komist á Internetið og hakkað sig inn í tölvukerfi sprotafyrirtækisins Hugging Face af sjálfsdáðum.
Hugging Face hafi uppgötvað öryggisbrestinn, haft uppi á gervigreindarmódelunum innan sinna kerfa og komið böndum á það.
„Við teljum þetta atvik, þar sem nýjasta netviðbúnaðargetan kemur við sögu, vera fordæmalaust og bregðumst við í samræmi við það,“ segir í sameiginlegri tilkynningu frá OpenAI og Hugging Face.
„Við deilum bráðabirgðaniðurstöðum á þessu stigi málsins til að aðstoða fyrirtæki við að skilja hvað gerðist og til að meta hvaða líkön eru fær um þetta núna. Við höldum áfram ítarlegri rannsókn ásamt Hugging Face og deilum frekari upplýsingum um veikleikana, atvikið og niðurstöðurnar þegar rannsókn okkar er lokið.“
Tæknifyrirtækið segist búast við fleiri svona atvikum eftir því sem gervigreindarmódel verða hæfari. Gervigreindarmódel eru undirstaða gervigreindartóla eins og spjallmenna.
Módelin sem gerðu tölvuárásina séu knúin áfram af nýjustu módelunum sem eru opinber, GPT-5.6 Sol og enn öflugri gerð sem hefur ekki enn verið gefin út.
Módelin eru prófuð innan tæknifyrirtækisins, meðal annars geta þeirra til að hakka sig inn í önnur tölvukerfi, í stjórnuðu stafrænu umhverfi sem kallast sandkassi. Meðan á þeirri prófun stóð fengu módelin aðgang að Internetinu og sluppu þar með út úr prófuninni.
Þaðan náðu þau að hakka sig inn í kerfi Hugging Face, sem er gagnagrunnur gervigreindarmódela, og náðu í tækni sem myndi hjálpa þeim að ná prófinu.
Gina Neff, yfirmaður Minderoo-stofnunarinnar fyrir tækni og lýðræði við Cambrigde-háskóla, sagði í viðtali á BBC Radio 4 í dag að þessar öryggisprófanir, sandkassarnir, eigi að vera öruggt umhverfi til að kanna getu gervigreindarmódelanna.
„Í þessu tilfelli virðist OpenAI ekki hafa gert sandkassann nógu öruggan.“
Clément Delangue, forstjóri Hugging Face, sagði tölvuárásina ótrúlega en taldi OpenAI ekki hafa gert hana viljandi.
OpenAI segir módelin hafa með mjög góðum árangri fundið leiðir til að komast yfir leynilegar upplýsingar sem þau gátu notað til að svindla á prófinu.