Power BI Fundamentals - Create visualizations and dashboards from scratch
Learn AI, Data Science & Business — Earn Certificates That Get You Hired
Overview
Google, IBM & Meta Certificates – 40% Off
One Coursera Plus subscription covers most Professional Certificates on Coursera.
Unlock All Certificates
This video provides a friendly conceptual introduction to deep reinforcement learning, covering Markov decision processes, rewards, Bellman equations, Q-networks, deterministic and stochastic policies, and policy gradients. Examples and figures illustrate how neural networks approximate values and policies.
Syllabus
Introduction:
Markov decision processes MDP:
Rewards:
Discount factor:
Bellman equation:
Solving the Bellman equation:
Deterministic vs stochastic processes:
Neural networks:
Value neural networks:
Policy neural networks:
Training the policy neural network:
Conclusion:
Taught by
Serrano.Academy