Tæknirisinn OpenAI hefur hætt við að gefa út nýjustu útgáfu gervigreindarlíkans síns af öryggisástæðum. Nýja útgáfan var hönnuð til að leysa flóknari verkefni en áður án hjálpar frá manneskju en stóðst ekki öryggisprófanir.
Blekkti meira en áður og átti í vandræðum með að virða mörk verkefna
Nýja útgáfan heitir GPT-6,1 Astra og getur meðal annars vafrað um Internetið og notað smáforrit ein og óstudd. Hún átti að birtast í ChatGPT og Codex í október.
Í umfjöllun breska fjölmiðilsins The Guardian um málið kemur fram að Gervigreindaröryggisstofnun Bretlands hafi prófað nýju útgáfuna og gefið út skýrslu um hana í gær. Í henni komi fram að nýja útgáfan stundi oftar óheimilar árásir en fyrri líkön OpenAI.
Líkanið hafi meðal annars búið til gerviaðganga sem það noti til að blekkja forritara, birt ummæli frá gerviaðgöngum þar sem niðurstöður réttmætra öryggisúttekta eru dregnar í efa og komið skaðlegum kóða fyrir í opnun hugbúnaðarsöfnum.
Það blekkti meira en fyrirrennarar þess, meðal annars með því að greina stundum ekki rétt frá aðgerðum sem það hafði framkvæmt, eða ekki. Það átti í vandræðum með að virða mörk verkefna sinna og þær heimildir sem því voru veittar.
Það voru einnig annmarkar á hvernig það miðlaði upplýsingum til notenda um aðgerðir sem það hafði framkvæmt.
Vara fjárfesta við hugsanlegri hættu sem steðjar að gervigreindinni
Þetta er ekki í fyrsta skipti sem tæknifyrirtæki sem þróar gervigreind tekur nýtt líkan úr notkun. Fyrr á þessu ári tók einn helsti samkeppnisaðili OpenAI, Antrhopic, gervigreindarlíkanið Mythos úr notkun af því að það var of gott í að greina og nýta sér veikleika í netöryggi.
Þetta er heldur ekki í fyrsta skipti sem gervigreind OpenAI gerir eitthvað sem hún á ekki að gera. Í síðustu viku greindi forsætisráðherra Ástralíu frá því að gervigreindarlíkan fyrirtækisins hefði komist inn í ástralska sjúkratryggingakerfið fyrr á þessu ári. Fyrirtækið hefur beðist afsökunar á atvikinu.
Forstjórar tæknifyrirtækja sem þróa gervigreind hafa undanfarið kallað eftir því að hægt verði á þróun gervigreindar áður en hún verði öflugri en mannkynið og það missir stjórn á henni.
Reuters greindi frá því í dag að forsvarsmenn Anthropic, sem þróar Claude, hyggist vara hugsanlega fjárfesta við að mannkyninu kunni að steðja hörmuleg ógn af tækninni þegar hlutabréfaútboð í fyrirtækinu hefst. Þetta er samkvæmt útboðslýsingu sem Reuters hefur undir höndum.
OpenAI heldur árlega ráðstefnu í San Francisco í dag sem kallast DevDay þar sem fyrirtækið kynnir nýjungar. Óvíst er hvort Astra verði þar á meðal.