180: Reinforcement Learning

180: Reinforcement Learning

Patrick and Jason introduce reinforcement learning and place it alongside supervised and unsupervised learning. They cover Q-learning, SARSA, policy gradients, actor-critic methods, PPO, imitation learning, and why training and evaluating RL systems is so challenging.

Denne episoden er hentet fra en åpen RSS-feed og er ikke publisert av Podme. Den kan derfor inneholde annonser.

Episoder(190)

Populært innen Politikk og nyheter

aftenpodden
giver-og-gjengen-vg
forklart
popradet
aftenpodden-usa
stopp-verden
nokon-ma-ga
fotballpodden-2
det-store-bildet
lydartikler-fra-aftenposten
bt-dokumentar-2
dine-penger-pengeradet
hanna-de-heldige
rss-espen-lee-usensurert
rss-gukild-johaug
aftenbla-bla
rss-ness
e24-podden
frokostshowet-pa-p5
liverpoolno-pausepraten