mlReinforcement Learning강화학습On this page강화학습 Reinforcement Learning 강화학습 상호작용을 통해 배우는 것으로 무엇을 해야할지(action과 policy를 어떻게 연결할지) 배우고 숫자로된 reward를 최대화 하는 것입니다. 강화학습은 두가지 특징이 있습니다. 시도와 오류 지연된 보상 Main Elements of RL Policy Reward signal Value function Model play 수행 action 행동 value 가치 reward 보상