Notice
Recent Posts
Recent Comments
Link
반응형
| 일 | 월 | 화 | 수 | 목 | 금 | 토 |
|---|---|---|---|---|---|---|
| 1 | 2 | |||||
| 3 | 4 | 5 | 6 | 7 | 8 | 9 |
| 10 | 11 | 12 | 13 | 14 | 15 | 16 |
| 17 | 18 | 19 | 20 | 21 | 22 | 23 |
| 24 | 25 | 26 | 27 | 28 | 29 | 30 |
| 31 |
Tags
- 머신러닝
- coding
- 사이드프로젝트
- 강화학습
- Reinforcement Learning
- expo
- selenium
- TeachagleMachine
- Ai
- 음성합성
- ReactNative
- React
- JavaScript
- 클론코딩
- 카트폴
- 논문리뷰
- DeepMind
- 강화학습 기초
- pandas
- 전국국밥
- FirebaseV9
- 딥러닝
- Ros
- clone coding
- 데이터분석
- 앱개발
- python
- Instagrame clone
- App
- TTS
Archives
- Today
- Total
목록Dreamer (1)
qcoding
[AI논문리뷰-강화학습] Dreamer - 잠재 공간에서 상상하고 역전파로 행동을 학습한 모델 기반 강화학습
논문 Dream to Control: Learning Behaviors by Latent Imagination 저자 Hafner et al. (Google Brain / DeepMind) 학회/연도 ICLR 2020 arXiv 1912.01603📄 한 문단 요약Dreamer는 Google Brain이 ICLR 2020에 발표한 모델 기반 강화학습 알고리즘이다. 핵심 아이디어는 세 단계다: ① RSSM(Recurrent State Space Model)으로 세계 모델을 학습하고, ② 실제 환경 없이 이 세계 모델 안에서 H=15 스텝을 상상(imagination)한 뒤, ③ 상상 궤적을 통해 역전파(backpropagation)로 Actor-Critic을 직접 최적화한다. 덕분에 DeepMind ..
AI논문리뷰-강화학습
2026. 5. 2. 09:53