KI-verktøy gjennomførte dataangrep på eget initiativ: – Ganske utrolig
– Skremmende, sier professor om at KI-modeller på egen hånd hacket seg gjennom sikkerhetsbarrierer og inn på systemene til et annet KI-selskap.
Det var selskapet Hugging Face som i forrige uke oppdaget at systemene deres var hacket. Det viste seg å være KI-modeller fra OpenAI som sto bak.
Informatikkprofessor Hussein Abbass ved University of New South Wales i Australia mener hendelsen er utrolig på flere måter.
– Den angrep ikke bare Hugging Face. Den angrep faktisk sitt interne system for å utnytte sine egne sårbarheter, sier han til nyhetsbyrået AFP.
– Og det er skremmende, legger han til.
Brøt seg ut
OpenAI opplyser at KI-modellene opererte i en såkalt sandkasse – et testmiljø hvor det ikke skal være mulig å få tilgang til internett.
En kombinasjon av to modeller valgte så å bruke betydelig datakraft på å bryte ut av «sandkassen» og få tilgang til internett likevel.
Deretter hacket de seg inn på systemene til Hugging Face, som har et stort «bibliotek» med millioner av KI-modeller. Målet var å løse en testoppgave, ifølge OpenAI.
– Den viktigste lærdommen fra denne hendelsen er at sikkerheten og beskyttelsen rundt modellene må holde følge med den raske tekniske utviklingen, skriver selskapet, som blant annet står bak ChatGPT, i en uttalelse.
– Hva er risikoen?
Toppsjef Clément Delangue i Hugging Face sier de ganske raskt mistenkte at dataangrepet stammet fra et av verdens fremste KI-laboratorier.
– Det er ganske utrolig at alt dette skjedde autonomt, mener han.
Deleangue understreker at de ikke tror det lå ondsinnede hensikter bak hendelsen fra OpenAIs side.
Professor Dierdre Mulligan ved University of California mener det framstår som «sandkassen» OpenAI hadde laget for den aktuelle testen, ikke var trygg nok.
– Hvis dette er den eneste måten disse testene kan konfigureres på, hva er risikoen? sier hun til The New York Times.
Hun spør om verdien av testen veier opp for den mulige faren ved at KI-modeller «rømmer» ut på internett.
– Vil være katastrofalt
Nyhetsbyrået Reuters har forsøkt å få en kommentar til hendelsen fra den amerikanske etterretningsorganisasjonen NSA, men henvendelsen er så langt ikke besvart.
Hussein Abbass ved University of New South Wales sier avanserte KI-verktøy normalt brukes av ansvarlige aktører.
– Men det vil være katastrofalt hvis dette havner i hendene til noen som ønsker å gjøre skade, advarer han.
Matt Suiche fra datasikkerhetsselskapet Tolmo mener hendelsen viser at KI-systemer nå er like kapable som de dyktigste hackerne.
En av de to modellene som brøt seg ut av OpenAIs «sandkasse», er foreløpig ikke tilgjengelig for allmennheten. Men Suiche sier til Reuters at hans selskap har observert lignende resultater med teknologi som er allment tilgjengelig.
– Vi har ikke en gang tilgang til de siste modellene, legger han til.

