Pekiştirmeli öğrenme: ödülle öğrenmek
Etiket yok, doğru cevap yok. Sadece hedefe varınca +1, çukura düşünce −1. Ajan bunu 400 denemede tek başına çözüyor.
4 adım
175 XP
Ücretsiz hesap gerekiyor
Derse başla →
Kaynaklar
- Sutton, R. S. & Barto, A. G. 2018 · Reinforcement Learning: An Introduction, 2. baskı, Bölüm 6.5 · MIT Press
- Watkins, C. J. C. H. & Dayan, P. 1992 · Q-learning · Machine Learning, 8(3-4)
- Mnih, V. ve ark. 2015 · Human-level Control through Deep Reinforcement Learning · Nature, 518
ML Academy · tarayıcıda çalışan interaktif makine öğrenmesi kursu ·
Bütün dersler