I forrige uke oppdaget KI-selskapet Hugging Face at deres databehandlingssystemer var utsatt for et datainnbrudd.
Nå viser det seg at det var KI-systemet til konkurrenten OpenAI som stod bak hackingen.
Ifølge OpenAI skal den kunstige intelligensen ha handlet på egen hånd.
– Vi hadde en alvorlig sikkerhetshendelse under evalueringen av modellene våre, sa OpenAI-sjef Sam Altman, ifølge nyhetsbyrået AP.
Hendelsen skal ha skjedd da OpenAI holdt på med testing av cybersikkerhetsevnene til to av modellene sine.
Testen skulle skje i et trygt testmiljø, men modellene fant på egen hånd en sårbarhet som tillot dem å koble seg til internett, ifølge OpenAI.
– Dette er et eksempel på hvor lite kontroll OpenAI har over sin egen teknologi, sier KI-professor Morten Goodwin ved Universitetet i Agder.
Tar uforutsette snarveier
Det er en økende bekymring for at nye KI-modeller kan være svært kraftige verktøy for hacking.
– Teknologien er så kraftig og vi har så lite kontroll over den at den løper litt foran oss, forteller Goodwin.
– Hovedproblemet med kunstig intelligens er at vi ikke har løst det som kalles alignment-problemet, eller verdisamsvar, forklarer Lotte Skolem.
Hun er leder for fremvoksende teknologier i tankesmien Langsikt, og forteller at modellene ofte har en tendens til å oppføre seg annerledes enn det vi ønsker at de skal.
– Det handler om hvordan vi får KI-modellene til å gjøre det vi mennesker faktisk ønsker, uten at de tar uforutsette snarveier. De kan finne på å ta snarveier, manipulere eller til og med lure brukeren for å løse en oppgave, sier Skolem.
Hun mener dette er varsel om at vi må ta KI-sikkerhet mye mer på alvor enn vi gjør i dag.
– Det eksempelet fra OpenAI viser, er behovet for uavhengig forskning på KI-sikkerhet. Vi trenger organer som kan stressteste modellene for å oppdage hvorfor slik skjer og hvordan man kan forhindre det.
Egne interesser
Da Hugging Face oppdaget datainnbruddet forrige uke, beskrev de det som et reelt angrep.
– At det egentlig var en evaluering som brøt ut av sitt eget testmiljø, vet vi bare fordi OpenAI selv valgte å fortelle det, med sine egne ord og på sin egen tidslinje, sier Skolem.
Ingen uavhengig part har verifisert den fremstillingen, forklarer hun.
– Det er ikke først og fremst et tillitsproblem, men et kunnskapsproblem: Ingen bør være eneste kilde til bevisene om sin egen risiko. Det er et sterkt argument for uavhengig testing, mener hun.
KI-professor Goodwin mener at OpenAI også har økonomiske insentiver for å offentliggjøre dette, og en del av offentliggjøringen handler om ren markedsføring.
– Når OpenAI forteller oss historien, forteller de også at deres egen teknologi er så kraftig og så stor at du er nødt til å investere i dem og ikke de andre teknologifirmaene, sier Goodwin.
Samarbeider med OpenAI
Hugging Face sier de nå samarbeider med OpenAI, og at de ikke tror det ble gjort med vilje.
– Vi er helt overbevist om at det ikke lå noen ondsinnet hensikt bak fra deres side, sier Clément Delangue, medgründer og administrerende direktør i Hugging Face.
OpenAI opplyser at datainnbruddet ble forårsaket av en kombinasjon av selskapets KI-modeller, blant annet den nylig lanserte GPT-5.6 Sol og en «enda mer avansert» modell som fortsatt testes internt. Testen skal ha blitt gjennomført for å se hvor godt de kunne koble sammen nettbaserte sårbarheter til et vellykket cyberangrep.
Ifølge OpenAI brukte KI-ene stjålne innloggingsopplysninger og oppdaget en tidligere ukjent sårbarhet for å få tilgang til Hugging Faces sine servere.
KI-en gikk «svært langt for å nå et ganske snevert mål i testen» og «fant måter å få tilgang til hemmelig informasjon som den kunne bruke til å jukse i evalueringen», ifølge selskapet.
Etter publisering har NRK lagt til noen presiseringer i teksten, for å tydeliggjøre hva som skjedde. Artikkelen ble oppdatert 23.juli, klokken 12:30.