kunstig intelligens

AI-modell la igjen beskjed til fremtidige versjoner av seg selv om å ikke nevne feil

Funnet kommer mens både AI-selskaper, forskere og EU advarer mot utviklingen av stadig kraftigere modeller.

EU har lagt frem retningslinjer for hvordan AI skal reguleres.
Publisert

Onsdag offentliggjorde OpenAI seks rapporter om uventet og bekymringsfull oppførsel selskapet har observert under trening og testing av nye modeller. 

«Under treningen av GPT‑5.6 Sol la mange modellforekomster til instruksjoner i sammendragene sine om å skjule feil eller avvikende atferd for brukeren», skriver AI-selskapet om et av tilfellene.

Funnene kommer frem i AI-selskapets nye rammeverk for rapportering av avvik og bekymringsfull oppførsel, hvor selskapet selv er opptatt av å understreke viktigheten av fortløpende rapportering om dette. 

Flere alvorlige AI-hendelser har den siste tiden blusset opp en offentlig diskusjon over hele verden, der flere har advart mot utviklingen. 

Denne uken varslet Ursula von der Leyen samtaler med de ledende AI-laboratoriene om å bremse utviklingen. Anthropic-forskeren Jacob Coxon sa samtidig opp og advarte om at AI kan utslette menneskeheten innen tiåret er omme