| 일 | 월 | 화 | 수 | 목 | 금 | 토 |
|---|---|---|---|---|---|---|
| 1 | 2 | 3 | 4 | 5 | 6 | |
| 7 | 8 | 9 | 10 | 11 | 12 | 13 |
| 14 | 15 | 16 | 17 | 18 | 19 | 20 |
| 21 | 22 | 23 | 24 | 25 | 26 | 27 |
| 28 | 29 | 30 | 31 |
- YoLO
- hm3d
- 백준
- AlexNet
- deep learning
- LSTM
- DP
- BFS
- dfs
- 강화학습
- GIT
- RL
- 딥러닝
- eecs 498
- hm3dsem
- Reinforcement Learning
- dynamic programming
- C++
- real-time object detection
- machine learning
- CNN
- r-cnn
- opencv
- 그래프 이론
- image processing
- NLP
- ubuntu
- MySQL
- 머신러닝
- Python
- Today
- Total
목록Reinforcement Learning (8)
JINWOOJUNG
본 포스팅은 UC Berkeley 에서 진행된 CS285: Deep Reinforcement Learning, Decision Making and Control강의자료 및 강의를 기반으로 공부한 내용을 정리하는 포스팅입니다.앞선 내용과 이어지는 포스팅입니다. 꼭 공부하시고 오시기 바랍니다!!https://jinwoo-jung.tistory.com/169 [RL] CS285: Lecture 02. Supervised Learning of Behaviors(1)본 포스팅은 UC Berkeley 에서 진행된 CS285: Deep Reinforcement Learning, Decision Making and Control강의자료 및 강의를 기반으로 공부한 내용을 정리하는 포스팅입니다.https://jinwoo-..
본 포스팅은 UC Berkeley 에서 진행된 CS285: Deep Reinforcement Learning, Decision Making and Control강의자료 및 강의를 기반으로 공부한 내용을 정리하는 포스팅입니다.https://jinwoo-jung.tistory.com/168 [RL] CS285: Lecture 01. Introduction본 포스팅은 UC Berkeley 에서 진행된 CS285: Deep Reinforcement Learning, Decision Making and Control 강의자료 및 강의를 기반으로 공부한 내용을 정리하는 포스팅입니다.Introduction다음과 같은 Robot이 있다고 가정jinwoo-jung.comTerminology & Notation강화학습에 ..
본 포스팅은 UC Berkeley 에서 진행된 CS285: Deep Reinforcement Learning, Decision Making and Control 강의자료 및 강의를 기반으로 공부한 내용을 정리하는 포스팅입니다.Introduction다음과 같은 Robot이 있다고 가정하자. RGB camera를 통해 객체들을 볼 수 있으며, 7 자유로들 가진 manipulator를 통해 객체들을 조작할 수 있다. 그리고 우리에게 주어진 Task는 특정 물체를 집어 통 밖으로 꺼낸다고 가정하자. 그러면 우리는 입력받은 이미지를 통해 우리의 방법론을 통해 물체를 집을 (x,y,z) 좌표를 만들어야 한다. 그렇다면 2가지 방법이 있을 것이다. 첫번째 방법은 Hard coding 하는 방법이다. 하지만, 수많은..
본 게시글은 인하대학교 유상조 교수님의 Reinforcement Learning Tutorial Seminar 수강 후 정리를 위한 포스팅입니다. 모든 포스팅의 저작관은 유상조 교수님에게 있음을 사전 공지합니다. Before This Episode https://jinwoo-jung.tistory.com/32 Q-Learning 본 게시글은 인하대학교 유상조 교수님의 Reinforcement Learning Tutorial Seminar 수강 후 정리를 위한 포스팅입니다. 모든 포스팅의 저작관은 유상조 교수님에게 있음을 사전 공지합니다. Before This Episode jinwoo-jung.tistory.com TD에서 파생된 SARSA, Q-Learning 모두 one-step으로 Q를 Update..
본 게시글은 인하대학교 유상조 교수님의 Reinforcement Learning Tutorial Seminar 수강 후 정리를 위한 포스팅입니다. 모든 포스팅의 저작관은 유상조 교수님에게 있음을 사전 공지합니다. Before This Episode https://jinwoo-jung.tistory.com/30 Temporal Difference Method 본 게시글은 인하대학교 유상조 교수님의 Reinforcement Learning Tutorial Seminar 수강 후정리를 위한 포스팅입니다. 모든 포스팅의 저작관은 유상조 교수님에게 있음을 사전 공지합니다. Before This Episode jinwoo-jung.tistory.com 지난 시간까지 MC, TD에 대하여 살펴 보았다. Optimal..
본 게시글은 인하대학교 유상조 교수님의 Reinforcement Learning Tutorial Seminar 수강 후정리를 위한 포스팅입니다. 모든 포스팅의 저작관은 유상조 교수님에게 있음을 사전 공지합니다. Before This Episode https://jinwoo-jung.tistory.com/29 Monte Carlo Method 본 게시글은 인하대학교 유상조 교수님의 Reinforcement Learning Tutorial Seminar 수강 후정리를 위한 포스팅입니다. 모든 포스팅의 저작관은 유상조 교수님에게 있음을 사전 공지합니다. Before This Episode jinwoo-jung.tistory.com DP는 Model을 알기 때문에 $v(S)$를 policy에 의해 선택되는 ac..
본 게시글은 인하대학교 유상조 교수님의 Reinforcement Learning Tutorial Seminar 수강 후정리를 위한 포스팅입니다. 모든 포스팅의 저작관은 유상조 교수님에게 있음을 사전 공지합니다. Before This Episode https://jinwoo-jung.tistory.com/21 Dynamic Programming 본 게시글은 인하대학교 유상조 교수님의 Reinforcement Learning Tutorial Seminar 수강 후정리를 위한 포스팅입니다. 모든 포스팅의 저작관은 유상조 교수님에게 있음을 사전 공지합니다. Before This Episode jinwoo-jung.tistory.com 지난시간에 학습한 DP의 경우 Model을 알고 있기에 적용 가능한 Metho..
본 게시글은 인하대학교 유상조 교수님의 Reinforcement Learning Tutorial Seminar 수강 후 정리를 위한 포스팅입니다. 모든 포스팅의 저작관은 유상조 교수님에게 있음을 사전 공지합니다. Reinforcement Learning 강화학습은 Machine Learning의 subfield이다. Machine Learning Tasks로는 크게 Supervised/Unsupervised/Reinforcement learning으로 분류할 수 있다. Supervised Learning(지도학습) : labeled dataset으로 학습이 진행되며, classification/regression task에 사용된다. Unsupervised Learning(비지도 학습) : label이 ..