arXiv (Cornell University)· 2016· Ön baskı
Derin Pekiştirmeli Öğrenme ile Sürekli Kontrol
Continuous control with deep reinforcement learning
- 6.787atıf
- 2016yıl
Kısa özet
Model-tabanlı olmayan, yeni bir aktör-kritik algoritması olan Deterministik Politika Gradyanı (DPG), 20'den fazla simüle edilmiş fizik görevini sürekli eylem alanlarında sağlam bir şekilde çözerek planlama algoritması performansına ulaşıyor ve ham piksellerden uçtan uca öğreniyor.
Yapay zekâ ile başlık ve abstract'tan üretildi; tam metin okunmaz.
Devamı Pofolia uygulamasında
Çıkarımlar, ana noktalar ve makaleye soru sorma; ilgi alanına göre her gün yeni özetler. Ücretsiz.
Web'de giriş yaparak açAlan: Yapay Zeka
Artificial IntelligenceComputer Science