← Maskinlæring

Reinforcement Learning

Forsterkningslæring

En læringsmetode der AI-en lærer gjennom prøving og feiling, med belønning for gode handlinger og straff for dårlige - akkurat som å trene en valp med godbit.

AI som lærer å spille sjakk ved å spille millioner av partier mot seg selv og lære av seire og tap.

Kilde: IBM →