RL: Value Function Formula Visualization

Опубликовано: 08 Октябрь 2020
на канале: Naoshikuu
2,522
87

This little clip provides a visualization for the recursive formula of the value function v_pi(s) in Reinforcement Learning. It illustrates a simple way to read a backup diagram in order to obtain the corresponding formula.


This was done using manim, the free python library use by Grant Sanderson for his series 3blue1brown; do check them out!


На этой странице сайта вы можете посмотреть видео онлайн RL: Value Function Formula Visualization длительностью часов минут секунд в хорошем качестве, которое загрузил пользователь Naoshikuu 08 Октябрь 2020, поделитесь ссылкой с друзьями и знакомыми, на youtube это видео уже посмотрели 2,522 раз и оно понравилось 87 зрителям. Приятного просмотра!