'MRP' 태그의 글 목록

MRP 1

손으로 쓰는 강화학습(Reinforcement Learning) - (2) MP, MRP ~ MDP(feat. Bellman)

마르코프 결정 과정(Marcov Decision Process: MDP)은 강화학습 문제를 기술하는 수학적 표현방법. MDP 몇가지 전 단계 - 마르코프 과정(Markov Processes) or 마르코프 연쇄(Markov Chain)으로 불림 - 마르코프 보상 과정(Markov Reward PRocesses: MRP) - 마르코프 결정 과정(Markov Decision Process: MDP)

강화학습 2020.08.27

내 블로그 - 관리자 홈 전환	`Q` `Q`
새 글 쓰기	`W` `W`

글 수정 (권한 있는 경우)	`E` `E`
댓글 영역으로 이동	`C` `C`

이 페이지의 URL 복사	`S` `S`
맨 위로 이동	`T` `T`
티스토리 홈 이동	`H` `H`
단축키 안내	`Shift` + `/` `⇧` + `/`

데분데싸

MRP 1

티스토리툴바

개인정보

단축키

내 블로그

블로그 게시글

모든 영역