Sign up to save your podcastsEmail addressPasswordRegisterOrContinue with GoogleAlready have an account? Log in here.
March 04, 2026(Math.RL)_09장_Policy_Gradient_Methods - 정책 경사법 테이블에서 함수로의 확장(Math.RL)_09장_Policy_Gradient_Methods - 정책 경사법 테이블에서 함수로의 확장...more10minPlay
March 04, 2026(Math.RL)_08장_Value_Function_Methods - 가치 함수 근사와 TD 학습의 원리 및 알고리즘(Math.RL)_08장_Value_Function_Methods - 가치 함수 근사와 TD 학습의 원리 및 알고리즘...more10minPlay
March 03, 2026(Math.RL)_07장_Temporal_Difference_Methods - 시간차 학습 TD 및 Q-러닝 알고리즘 분석(Math.RL)_07장_Temporal_Difference_Methods - 시간차 학습 TD 및 Q-러닝 알고리즘 분석...more17minPlay
March 03, 2026(Math.RL)_06장_Stochastic_Approximation - 확률적 근사와 로빈스-먼로 알고리즘의 기초(Math.RL)_06장_Stochastic_Approximation - 확률적 근사와 로빈스-먼로 알고리즘의 기초...more20minPlay
March 03, 2026(Math.RL)_05장_Monte_Carlo_Methods - 몬테카를로 방법과 모델 프리 강화학습의 기초(Math.RL)_05장_Monte_Carlo_Methods - 몬테카를로 방법과 모델 프리 강화학습의 기초...more16minPlay
March 03, 2026(Math.RL)_04장_Value_Iteration_and_Policy_Iteration - 가치 및 정책 반복 강화학습 최적 제어 알고리즘(Math.RL)_04장_Value_Iteration_and_Policy_Iteration - 가치 및 정책 반복 강화학습 최적 제어 알고리즘...more24minPlay
March 03, 2026(Math.RL)_03장_Optimal_State_Values_and_Bellman_Optimality_Equation - 벨만 최적 방정식과 최적 정책의 원리(Math.RL)_03장_Optimal_State_Values_and_Bellman_Optimality_Equation - 벨만 최적 방정식과 최적 정책의 원리...more25minPlay
March 03, 2026(Math.RL)_02장_State_Values_and_Bellman_Equation - 상태 가치와 벨만 방정식 강화학습의 수학적 기초(Math.RL)_02장_State_Values_and_Bellman_Equation - 상태 가치와 벨만 방정식 강화학습의 수학적 기초...more12minPlay
March 03, 2026(Math.RL)_01장_Basic_Concepts - 강화학습의 기초와 마르코프 결정 과정(Math.RL)_01장_Basic_Concepts - 강화학습의 기초와 마르코프 결정 과정...more16minPlay
March 03, 2026(Math.RL)_00장_Overview_of_this_Book - 수학적 강화학습의 구조와 핵심 알고리즘 개요(Math.RL)_00장_Overview_of_this_Book - 수학적 강화학습의 구조와 핵심 알고리즘 개요...more23minPlay