Uzun vadeli getirileri en üst düzeye çıkarmak için bir varlığın kaç biriminin hangi fiyattan alınıp satılacağını öneren otomatik bir alım satım aracısı oluşturuyorsunuz. Aracı, akış halindeki işlem verileri üzerinde sürekli olarak eğitilecektir. Uzun vadeli ödül optimizasyonu içeren bu sıralı karar verme problemi için hangi makine öğrenimi algoritması uygundur?
Bir cevap seçin
Cevabınızı kontrol etmek için bir seçeneğe dokunun.
Doğru cevap: Pekiştirmeli öğrenme.
Neden bu cevap
Pekiştirmeli öğrenme (Reinforcement Learning), uzun vadeli ödülleri en üst düzeye çıkarmak için bir ortamda sıralı kararlar almayı öğrenen ajanlar için idealdir. Bu senaryoda, alım satım aracısı, alım satım kararları (eylemler) alarak piyasa ile etkileşime girer ve bu kararların sonucunda ödüller (kâr veya zarar) alır. Ajan, bu ödülleri kullanarak gelecekteki kararlarını optimize etmeyi öğrenir. Gözetimli öğrenme, etiketli verilere ihtiyaç duyar ve sıralı karar verme için uygun değildir. Gözetimsiz öğrenme, veri içindeki kalıpları bulmaya odaklanır ve ödül optimizasyonu içermez. Yarı gözetimli öğrenme ise hem etiketli hem de etiketsiz verileri kullanır ancak yine sıralı karar verme ve uzun vadeli ödül optimizasyonu için birincil yöntem değildir.
Sonsuz cevap arayışı olmadan sınavınızı geçin
Bu sınav için her doğrulanmış soruyu ve açıklamayı tek bir yerde edinin ve saatlerce süren hazırlıktan tasarruf edin. 1.000'den fazla sertifika · 20'den fazla dil · ücretsiz başlayın.
Sınavınızı daha hızlı geçin → Kart gerekmez