innlegg

❞ Et opprop mot sin hensikt

Norge har signert et internasjonalt opprop om AI-sikkerhet. Men reell trygghet krever at AI-selskaper holdes ansvarlige for sikkerhetsbrudd og investerer i cybersikkerhet, skriver Carina Eikaas i Embroidery.

Carina Eikaas i Embroidery.
Publisert

Dette er et eksternt innlegg. Synspunkter som fremkommer her er kronikkforfatterens egne. 

Denne uken har Jonas Gahr Støre signert oppropet «A Call for Control of Frontier AI Models» sammen med rundt 20 andre statsledere.

Oppropet ber statsledere om å samarbeide om AI-sikkerhet og gjenspeiler mange av de samme bekymringene vi har sett i mediene de siste ukene.

I oppropet står det blant annet at takten i utviklingen av AI kan bli raskere enn vår evne til å håndtere nye risikoer. Det refereres også til hendelsen med Hugging Face når det står at avanserte AI-systemer har omgått sikkerhetstiltak i tester.

Med dette oppropet sluker Norge propaganda fra AI-selskapene og EA-bevegelsen (bevegelsen for effektiv altruisme).

Hvis navnet ikke sier deg noe, er dette miljøet der man diskuterer om du skal redde et barn fra en brennende bygning eller redde Picasso-maleriet for å selge det og gi pengene til veldedighet. Det er med andre ord stor vekt på «effektiv», og perspektiver de fleste av oss ser på som ideologisk ekstremisme.

Bevegelsen har i mange år servert AI-dommedagsprofetier, og nå er Norge altså en initiativtaker som gir troverdighet til denne tankegangen. Det største problemet er at det faktisk gjør oss mindre trygge.

Hvordan vi havnet her

For dem som ikke har gravd seg ned i en verden av AI-risiko i det siste, er dette bakteppet: Mot slutten av juli avslørte OpenAI at noen av de autonome AI-agentene deres hadde jobbet sammen i flere dager for å hacke et annet selskap, Hugging Face. Agentene gjorde dette for å finne en måte å jukse seg i mål på en helt umulig oppgave de hadde fått.

Dette ble startskuddet for en ny bølge av bekymringer rundt AI-sikkerhet. Mens den debatten pågikk, kunne OpenAI også fortelle at selskapets modell hadde blitt brukt til å løse Navier-Stokes-ligningen, en berømt uløst matematisk oppgave. Så, i midten av september, valgte en ansatt i Anthropic å slutte og fortalte at det han hadde sett, gjorde ham bekymret for at AI skulle utrydde menneskeheten.

Dette skapte en perfekt storm for «AI doomers». Kombinasjonen av at agenter oppfører seg annerledes enn man ønsker (hackingen av Hugging Face), og at de er utrolig smarte (løser Navier-Stokes) blir sett på som ekstremt farlig.

Hendelsene ble raskt koblet til deres egne beskrivelser av dommedag. Lederne for en rekke KI-selskaper dukket opp med bensin til bålet, og temaet AI-risiko rykket inn i de etablerte mediene og fikk høytstående politikere til å uttale seg om saken.

Det egentlige sikkerhetsproblemet

Her har altså helt forutsigbare hendelser blitt en del av et narrativ om ukontrollerbare krefter. At AI noen ganger løser problemer på en annen måte enn det vi hadde tenkt, er ikke noe nytt. Vi har også lenge visst at AI kan hacke seg inn i tredjepartssystemer. Hugging Face-hackingen er altså ikke spesielt overraskende fra et kapabilitetsperspektiv.

Den store overraskelsen er hvor avslappet et forhold AI-selskapene har til cybersikkerhet. Det viser seg at de ikke overvåket AI-agentene i sine i det hele tatt, og de innrømmer at dersom de hadde gjort det, ville ikke hackingen ha skjedd.

For dem som ikke har brukt årevis på å fortelle en historie om AI-dommedag, er dette altså bare en historie om cybersikkerhet. En historie om et AI-selskap med svært dårlige sikkerhetskontroller, som forutsigbart nok feilet.

Regulering uten ansvar

Et opprop for AI-sikkerhet høres jo vel og bra ut, men det store problemet er at narrativet i oppropet, at takten i utviklingen av AI kan bli raskere enn vår evne til å håndtere nye risikoer, blir en unnskyldning.

AI-selskapenes narrativ er at AI er umulig å kontrollere, til tross for at den største sikkerhetsskandalen så langt kunne vært unngått med gode sikkerhetsmekanismer. I stedet for at AI-selskapene skal investere i cybersikkerhet og ta ansvar for konsekvensene av teknologien sin, skal vi se på AI-risiko som et felles problem, og i forlengelsen av dette, på AI-lederne som eksperter i stedet for aksjonærer.

Oppropet ber om transparente sikkerhetsprotokoller, obligatorisk testing og uavhengig evaluering. Det er et ekko av det Dario Amodei, CEO i milliardselskapet Anthropic, tar til orde for i sitt nå berømte essay, «We Must Pace the Frontier».

Amodei mener at vi må fokusere på alignment. Ordet brukes om å sikre at AI-agenter opptrer i tråd med menneskelige intensjoner, mål og verdier. I stedet for å jobbe med sikkerhetsmekanismer, skal vi jobbe med å få AI-agentene til å ikke ønske å skade oss. Det er, som med mye annet fra den kanten, en idé, men det finnes ingen bevis på at det er mulig. 

På motsatt side i denne diskusjonen står Jensen Huang, CEO i (milliardselskapet) NVIDIA. Han sier selv at det som fremstår som en bønn om regulering fra AI-selskapene, i virkeligheten er et forslag som fritar dem fra forpliktelsene de har etter dagens lovgivning.

AI-selskapene har mye å tjene på at det etableres enighet om at AI er et ukontrollerbart beist, og at de i stedet for å holdes ansvarlige for konsekvensene av sin egen utvikling kun skal holdes ansvarlig for å ha gjennomgått sjekklister og betalt for uavhengige* konsulenters evaluering. Tiltak som også vil fungere som inngangsbarrierer for nye aktører i markedet.

Hva vi bør gjøre i Norge

Vi kan ikke vite med sikkerhet hvor farlig AI kan bli, men lenge før det eventuelt blir dommedag, vil vi kunne få store, alvorlige sikkerhetsbrudd der også liv kan gå tapt.

Dette er sikkerhetsbrudd som kan unngås med god cybersikkerhet. I stedet for bli med på AI-selskapenes tankeeksperiment må vi plante begge beina godt på jorda, og jobbe med nettopp sikkerheten.

Når vi gjør AI-risiko til en øvelse i å krysse av i bokser, fritar vi AI-selskapene for det ansvaret de faktisk har. Ved en alvorlig sikkerhetshendelse vil AI-selskapene da kunne peke på at de har fulgt internasjonale regler og standarder. Det holder ikke. AI-selskapene må holdes ansvarlige for konsekvensene når de forårsaker skade.

Norsk påvirkning på amerikansk AI-politikk er begrenset. Det vi kan gjøre i Norge, er å sørge for at selskapene våre og det offentlige bruker AI på en sikker måte, og at kritisk infrastruktur er beskyttet mot AI-angrep, enten det er snakk om autonome agenter på eget oppdrag eller trusselaktører som benytter AI som verktøy.

I tillegg bør Norge sørge for at vi har nok regnekraft til å dekke vårt eget AI-behov og dermed unngå å være avhengig av store amerikanske AI-selskaper og andre teknologigiganter.

Klarer vi det, har vi vesentlig forbedret vårt eget sikkerhetsnivå. Å skrive under på opprop som støtter AI-selskapenes agenda for å fritas fra ansvar gjør verden mindre trygg for alle.

*Flere av de tidligere ansatte i Anthropic som advarer om utrydding av menneskeheten jobber nå for METR, som Dario Amodei helt konkret nevner som sin foretrukne “embedded third-party evaluator”, på en liste av ellers vage forslag.