Docs faviconDOCS우성짱의 문서
전체YouTubeArticleTagsAuthorsHub
홈/태그 찾기/#aa203
Tag1건YouTube 1

#aa203

이 태그와 연결된 문서를 한곳에서 모아보고, 함께 자주 등장하는 연관 태그까지 이어서 탐색할 수 있습니다.

연관 태그

#advantage-actor-critic공동문서 1 · 연관도 100%#baseline-reward-recentering공동문서 1 · 연관도 100%#learning-based-control공동문서 1 · 연관도 100%#monte-carlo공동문서 1 · 연관도 100%#course-lecture공동문서 1 · 연관도 71%#optimal-control공동문서 1 · 연관도 71%#stanford공동문서 1 · 연관도 58%#reinforcement-learning공동문서 1 · 연관도 41%
Stanford AA203 Optimal and Learning-Based Control
YouTube2026년 8월 13일

Stanford AA203 Optimal and Learning-Based Control

Stanford AA203 18강은 정책 그래디언트로 기대 누적 보상을 직접 최적화하고, reward to go·베이스라인·actor critic으로 추정량의 고분산을 낮추는 원리를 설명한다.

Stanford Online
#reinforcement-learning#optimal-control#learning-based-control#baseline-reward-recentering