This little clip provides a visualization for the recursive formula of the value function v_pi(s) in Reinforcement Learning. It illustrates a simple way to read a backup diagram in order to obtain the corresponding formula.
This was done using manim, the free python library use by Grant Sanderson for his series 3blue1brown; do check them out!
Nesta página do site você pode assistir ao vídeo on-line RL: Value Function Formula Visualization duração hora minuto segundo em boa qualidade , que foi baixado pelo usuário Naoshikuu 08 Outubro 2020, compartilhe o link com seus amigos e conhecidos, no youtube este vídeo já foi visto 2,522 vezes e gostou 87 espectadores. Boa visualização!