← Nevrale nettverk

GRU (Gated Recurrent Unit)

En forenklet versjon av LSTM med færre parametere - god for sekvenser men lettere å trene.

Brukes ofte i språkmodeller der du trenger å huske kontekst men vil ha raskere trening.

Kilde: Dive into Deep Learning →