Обучение с подкреплением
Марковские процессы принятия решений, Q-обучение, policy gradient
Другие названия: Reinforcement Learning, Марковские процессы принятия решений
4 записи лекций, около 18 часов
Записи лекций
- Stanford — Stanford CS224R Deep Reinforcement Learning, 19 лекций
- Прочие каналы — DeepMind x UCL | Deep Learning Lecture Series 2021, 13 лекций
- Прочие каналы — Reinforcement Learning Tutorials, 14 лекций
- Прочие каналы — DeepMind x UCL | Introduction to Reinforcement Learning 2015, 10 лекций
- Прочие каналы — Gymnasium (Deep) Reinforcement Learning Tutorials, 11 лекций
Что нужно знать заранее
Область знаний
Карта знаний