Reinforcement Learning ile Supervised Learning
Matematik
Geometri
Normal
Özet
Ödül-ceza sinyaliyle deneme yanılmadan öğrenmedir. İLE Etiketli veriyle doğru çıktıyı öğrenmedir. İlki ödülle, ikincisi etiketle öğrenir.
Ayrıntılı Açıklama
Formül: Q-learning
Formül
Q-learning
