Sign up to save your podcastsEmail addressPasswordRegisterOrContinue with GoogleAlready have an account? Log in here.
February 11, 2026(Grokking_DRL) 09장_More_stable_value_based_methods - 가치 기반 심층 강화학습의 안정화와 DQN 및 DDQN - AI의_착각과_불안정을_바로잡는_DQN의_비밀(Grokking_DRL) 09장_More_stable_value_based_methods - 가치 기반 심층 강화학습의 안정화와 DQN 및 DDQN - AI의_착각과_불안정을_바로잡는_DQN의_비밀...more16minPlay
February 11, 2026(Grokking_DRL) 08장_Introduction_to_value_based_deep_reinforcement_learning - 가치 기반 심층 강화학습의 기초와 NFQ의 이해 - AI에게_상상력을_부여하는_함수_근사의_원리(Grokking_DRL) 08장_Introduction_to_value_based_deep_reinforcement_learning - 가치 기반 심층 강화학습의 기초와 NFQ의 이해 - AI에게_상상력을_부여하는_함수_근사의_원리...more16minPlay
February 11, 2026(Grokking_DRL) 07장_Achieving_goals_more_effectively_and_efficiently - 효율적이고 효과적인 강화학습 자격 흔적과 모델 기반 방법론 - 자격_흔적과_모델로_경험_효율_극대화(Grokking_DRL) 07장_Achieving_goals_more_effectively_and_efficiently - 효율적이고 효과적인 강화학습 자격 흔적과 모델 기반 방법론 - 자격_흔적과_모델로_경험_효율_극대화...more16minPlay
February 10, 2026(Grokking_DRL) 06장_Improving_agents__behaviors - 강화학습 에이전트의 행동 개선과 제어 문제 해결 - 지도_없이_시행착오로_최적_행동_찾기(Grokking_DRL) 06장_Improving_agents__behaviors - 강화학습 에이전트의 행동 개선과 제어 문제 해결 - 지도_없이_시행착오로_최적_행동_찾기...more18minPlay
February 10, 2026(Grokking_DRL) 05장_Evaluating_agents__behaviors - 강화학습 에이전트의 가치 함수 추정과 정책 평가 기술 - 끝까지_가보는_MC와_한_걸음_예측하는_TD(Grokking_DRL) 05장_Evaluating_agents__behaviors - 강화학습 에이전트의 가치 함수 추정과 정책 평가 기술 - 끝까지_가보는_MC와_한_걸음_예측하는_TD...more16minPlay
February 10, 2026(Grokking_DRL) 04장_Balancing_the_gathering_and_use_of_information - 탐험과 이용의 균형 멀티 암드 밴딧 전략 - 후회_없는_선택을_위한_AI의_탐색_전략(Grokking_DRL) 04장_Balancing_the_gathering_and_use_of_information - 탐험과 이용의 균형 멀티 암드 밴딧 전략 - 후회_없는_선택을_위한_AI의_탐색_전략...more15minPlay
February 09, 2026(Grokking_DRL) 03장_Balancing_immediate_and_long_term_goals - 강화학습의 정책 최적화와 가치 함수 추정 원리 - 계획_대신_평가와_개선으로_정책을_최적화하라(Grokking_DRL) 03장_Balancing_immediate_and_long_term_goals - 강화학습의 정책 최적화와 가치 함수 추정 원리 - 계획_대신_평가와_개선으로_정책을_최적화하라...more16minPlay
February 09, 2026(Grokking_DRL) 02장_Mathematical_foundations_of_reinforcement_learning - 강화학습의 수학적 기초와 마르코프 결정 과정 - 불확실성을_이기는_인공지능의_수학적_전략(Grokking_DRL) 02장_Mathematical_foundations_of_reinforcement_learning - 강화학습의 수학적 기초와 마르코프 결정 과정 - 불확실성을_이기는_인공지능의_수학적_전략...more15minPlay
February 09, 2026(Grokking_DRL) 01장_Introduction_to_deep_reinforcement_learning - 심층 강화학습의 기초와 핵심 개념 입문 - 시행착오로_기계의_직관을_만드는_심층_강화학습(Grokking_DRL) 01장_Introduction_to_deep_reinforcement_learning - 심층 강화학습의 기초와 핵심 개념 입문 - 시행착오로_기계의_직관을_만드는_심층_강화학습...more18minPlay
February 08, 2026(강화학습) A Survey of Safe Reinforcement Learning and Constrained MDPs A Technical Survey on Single-Agent and Multi-Agent Safety - 안전 강화학습 및 제약 MDP 기술 동향 조사 - 절대_선을_넘지_않는_AI의_수학적_방패(강화학습) A Survey of Safe Reinforcement Learning and Constrained MDPs A Technical Survey on Single-Agent and Multi-Agent Safety - 안전 강화학습 및 제약 MDP 기술 동향 조사 - 절대_선을_넘지_않는_AI의_수학적_방패...more16minPlay