← AI og samfunn

KI-sikkerhet (AI safety)

KI-sikkerhet

Arbeidet med å gjøre KI trygg å bruke, både for deg og for samfunnet. Det handler om å hindre at en modell gir farlige svar, blir brukt til svindel eller oppfører seg uventet. Et nært beslektet ord er alignment, som handler om å få KI til å gjøre det menneskene faktisk ønsker.

Før et KI-selskap slipper en ny modell, tester det om modellen kan lures til å hjelpe noen med å lage skadelig programvare. Det er en del av sikkerhetsarbeidet.

Kilde: Anthropic →