📔 筆記內容: 赵世钰老師 “强化学习的数学原理” 課程 (也推薦用 Notion版本 來閱讀)
很高興我初次學習 RL 就是透過這門課, 讓我扎實理解其背後的數學和邏輯
老實說 RL 方法很多很雜, 套句趙老師的話, RL 數學很深, 結構性又很強, 一環扣一環
如果沒有這堂課這樣循序剖析和從數學出發解釋的話, 我自己應該很難入門, 謝謝這門課的赵世钰老師! 🙏🏻
本篇筆記方式盡量濃縮, 而每個章節更詳細的筆記參考:
$\circ$ RL(1): Fundamentals of Reinforcement Learning
$\circ$ RL(2): Sample-based Learning Methods
$\circ$ RL(3): Prediction and Control with Function Approximation

初次看到可能會很疑惑, 為啥要多 padding zero vectors? 本文就來解釋一下原因.