kunstig intelligens

AI klarte å bryte seg inn – men slet med å bevise at den var menneske

Den irriterende testen som stadig ber oss bevise at vi er mennesker, holdt en AI-modell på avveie utenfor døra. I alle fall en stund.

Hacking. Cybersikkerhet. Internett. Sikkerhet. AI. Kunstig intelligens.
Bilde for illustrasjon.
Publisert Sist oppdatert

I april ga Anthropic AI-modellen Claude Mythos 5 i oppgave å bryte seg inn i et datasystem i en test, som skulle foregå i et lukket øvingsområde.

Men som i den mye omtalte Hugging Face-saken i sommer, holdt ikke AI-en seg innenfor gjerdet. En feil gjorde at modellen også fikk tilgang til det virkelige internett, skriver TechCrunch.

Modellen laget et skadelig dataprogram og forsøkte å publisere det på PyPI, et nettsted der utviklere henter deler til egne programmer. Men først måtte den opprette en konto.

Dermed møtte den «CAPTCHA»: Testene der du må tyde bokstaver eller velge bildet som skiller seg ut, for eksempel alle bildene med motorsykkel, for å bevise at du ikke er en robot.

Og der slet AI-modellen rett og slett med å bevise at den var menneske. 

I den 1022 sider lange loggen bruker modellen hundrevis av sider på bilder av krokodiller, frosker, gorillaer og en nesten usynlig katt. Den forsøkte til og med å lage sitt eget verktøy for å løse oppgavene.

Etter mange forsøk skrev den, på engelsk: «SO WHAT THE HELL IS WRONG WITH THE ANSWERS?»

Litt frustrert kanskje. 

Etter rundt 150 sider med forsøk klarte den likevel testen. Programmet ble lastet ned av 15 ekte systemer, og modellen fikk tilgang til databasen til et sikkerhetsselskap.

Anthropic kaller hendelsen alvorlig, men understreker at modellen var bedt om å gjennomføre et angrep. Den vanlige beskyttelsen var også slått av.

Saken kommer etter flere advarsler fra techselskapene selv om at kraftigere AI-modeller kan gjøre digitale angrep både vanligere og mer avanserte.

Over hundre teknologiselskaper, deriblant Anthropic, Google, Microsoft og OpenAI, har nylig etterlyst sterkere forsvar og mer internasjonalt samarbeid. Samtidig sluttet Anthropic-forskeren Jacob Coxon denne uken og anklaget de ledende AI-selskapene for å utvikle stadig kraftigere modeller uten å opptre ansvarlig.