| 일 | 월 | 화 | 수 | 목 | 금 | 토 |
|---|---|---|---|---|---|---|
| 1 | 2 | 3 | 4 | 5 | 6 | 7 |
| 8 | 9 | 10 | 11 | 12 | 13 | 14 |
| 15 | 16 | 17 | 18 | 19 | 20 | 21 |
| 22 | 23 | 24 | 25 | 26 | 27 | 28 |
| 29 | 30 | 31 |
- 딥러닝
- Python
- dfs
- dynamic programming
- image processing
- machine learning
- UC Berkeley
- DP
- RL
- opencv
- LSTM
- hm3dsem
- AlexNet
- 그래프 이론
- C++
- 머신러닝
- GIT
- ubuntu
- CNN
- Reinforcement Learning
- BFS
- 강화학습
- r-cnn
- MySQL
- deep learning
- NLP
- hm3d
- 백준
- CS285
- YoLO
- Today
- Total
목록RL (10)
JINWOOJUNG
본 포스팅은 UC Berkeley 에서 진행된 CS285: Deep Reinforcement Learning, Decision Making and Control 강의자료 및 강의를 기반으로 공부한 내용을 정리하는 포스팅입니다.Introduction다음과 같은 Robot이 있다고 가정하자. RGB camera를 통해 객체들을 볼 수 있으며, 7 자유로들 가진 manipulator를 통해 객체들을 조작할 수 있다. 그리고 우리에게 주어진 Task는 특정 물체를 집어 통 밖으로 꺼낸다고 가정하자. 그러면 우리는 입력받은 이미지를 통해 우리의 방법론을 통해 물체를 집을 (x,y,z) 좌표를 만들어야 한다. 그렇다면 2가지 방법이 있을 것이다. 첫번째 방법은 Hard coding 하는 방법이다. 하지만, 수많은..
본 게시글은 인하대학교 유상조 교수님의 Reinforcement Learning Tutorial Seminar 수강 후 정리를 위한 포스팅입니다. 모든 포스팅의 저작관은 유상조 교수님에게 있음을 사전 공지합니다. Before This Episode https://jinwoo-jung.tistory.com/33 n-Step Bootstrapping 본 게시글은 인하대학교 유상조 교수님의 Reinforcement Learning Tutorial Seminar 수강 후 정리를 위한 포스팅입니다. 모든 포스팅의 저작관은 유상조 교수님에게 있음을 사전 공지합니다. Before This Episode jinwoo-jung.tistory.com 앞으로 거슬러 올라가 Dynamic Programming(DP)를 생각 ..