cUIDuC5KCns
OpenAI-sjef Sam Altman kaller datainnbruddet en alvorlig hendelse. Foto: AFP

I forrige uke oppdaget KI-selskapet Hugging Face at deres databehandlingssystemer var utsatt for et datainnbrudd.

Nå viser det seg at det var KI-systemet til konkurrenten OpenAI som stod bak hackingen.

Ifølge OpenAI skal den kunstige intelligensen ha handlet på egen hånd.

– Vi hadde en alvorlig sikkerhetshendelse under evalueringen av modellene våre, sa OpenAI-sjef Sam Altman, ifølge nyhetsbyrået AP.

Bilde av Sam Altman sjefen i OpenAI. Han sitter på en scene med en mikrofon i hånden.
OpenAI er selskapet bak språkmodellen ChatGPT. Her holder OpenAI-sjef Sam Altman en tale i Paris. Foto: JOEL SAGET / AFP

Hendelsen skal ha skjedd da OpenAI holdt på med testing av cybersikkerhetsevnene til to av modellene sine.

Testen skulle skje i et trygt testmiljø, men modellene fant på egen hånd en sårbarhet som tillot dem å koble seg til internett, ifølge OpenAI.

– Dette er et eksempel på hvor lite kontroll OpenAI har over sin egen teknologi, sier KI-professor Morten Goodwin ved Universitetet i Agder.

Tar uforutsette snarveier

Det er en økende bekymring for at nye KI-modeller kan være svært kraftige verktøy for hacking.

– Teknologien er så kraftig og vi har så lite kontroll over den at den løper litt foran oss, forteller Goodwin.

– Hovedproblemet med kunstig intelligens er at vi ikke har løst det som kalles alignment-problemet, eller verdisamsvar, forklarer Lotte Skolem.

Hun er leder for fremvoksende teknologier i tankesmien Langsikt, og forteller at modellene ofte har en tendens til å oppføre seg annerledes enn det vi ønsker at de skal.

portrettfoto av Lotte Skolem i tenketanken Langsikt
– Hele sikkerhetsargumentet for å kjøre farlige evalueringer hviler på at man kan holde det farlige innelåst, sier Lotte Skolem i Langsikt Foto: The Life Science Cluster / ;

– Det handler om hvordan vi får KI-modellene til å gjøre det vi mennesker faktisk ønsker, uten at de tar uforutsette snarveier. De kan finne på å ta snarveier, manipulere eller til og med lure brukeren for å løse en oppgave, sier Skolem.

Hun mener dette er varsel om at vi må ta KI-sikkerhet mye mer på alvor enn vi gjør i dag.

– Det eksempelet fra OpenAI viser, er behovet for uavhengig forskning på KI-sikkerhet. Vi trenger organer som kan stressteste modellene for å oppdage hvorfor slik skjer og hvordan man kan forhindre det.

Egne interesser

Da Hugging Face oppdaget datainnbruddet forrige uke, beskrev de det som et reelt angrep.

– At det egentlig var en evaluering som brøt ut av sitt eget testmiljø, vet vi bare fordi OpenAI selv valgte å fortelle det, med sine egne ord og på sin egen tidslinje, sier Skolem.

Ingen uavhengig part har verifisert den fremstillingen, forklarer hun.

– Det er ikke først og fremst et tillitsproblem, men et kunnskapsproblem: Ingen bør være eneste kilde til bevisene om sin egen risiko. Det er et sterkt argument for uavhengig testing, mener hun.

En mann i dress går forbi en buet betongvegg i en offentlig bygning. I bakgrunnen sitter flere personer på en benk. Gulvflisene er lyse, og det er lamper langs veggen. Omgivelsene tyder på et moderne og urbant miljø. (Bildebeskrivelsen er laget av en KI-tjeneste)
– Vi ønsker mer kontroll av denne teknologien for dette er en av de teknologiene som vi er sikker på kommer til å påvirke oss veldig mye i fremtiden, sier professor i KI, Morten Goodwin. Foto: Erling Slyngstad Hægeland / Privat

KI-professor Goodwin mener at OpenAI også har økonomiske insentiver for å offentliggjøre dette, og en del av offentliggjøringen handler om ren markedsføring.

– Når OpenAI forteller oss historien, forteller de også at deres egen teknologi er så kraftig og så stor at du er nødt til å investere i dem og ikke de andre teknologifirmaene, sier Goodwin.

Samarbeider med OpenAI

Hugging Face sier de nå samarbeider med OpenAI, og at de ikke tror det ble gjort med vilje.

– Vi er helt overbevist om at det ikke lå noen ondsinnet hensikt bak fra deres side, sier Clément Delangue, medgründer og administrerende direktør i Hugging Face.

OpenAI opplyser at datainnbruddet ble forårsaket av en kombinasjon av selskapets KI-modeller, blant annet den nylig lanserte GPT-5.6 Sol og en «enda mer avansert» modell som fortsatt testes internt. Testen skal ha blitt gjennomført for å se hvor godt de kunne koble sammen nettbaserte sårbarheter til et vellykket cyberangrep.

Ifølge OpenAI brukte KI-ene stjålne innloggingsopplysninger og oppdaget en tidligere ukjent sårbarhet for å få tilgang til Hugging Faces sine servere.

KI-en gikk «svært langt for å nå et ganske snevert mål i testen» og «fant måter å få tilgang til hemmelig informasjon som den kunne bruke til å jukse i evalueringen», ifølge selskapet.

Etter publisering har NRK lagt til noen presiseringer i teksten, for å tydeliggjøre hva som skjedde. Artikkelen ble oppdatert 23.juli, klokken 12:30.