PofoliaPofolia ile paylaşıldı

arXiv (Cornell University)· 2016· Ön baskı

Derin Pekiştirmeli Öğrenme ile Sürekli Kontrol

Continuous control with deep reinforcement learning

Timothy Lillicrap, Jonathan J. Hunt, Alexander Pritzel, Nicolas Heess ve diğerleri

Kısa özet

Model-tabanlı olmayan, yeni bir aktör-kritik algoritması olan Deterministik Politika Gradyanı (DPG), 20'den fazla simüle edilmiş fizik görevini sürekli eylem alanlarında sağlam bir şekilde çözerek planlama algoritması performansına ulaşıyor ve ham piksellerden uçtan uca öğreniyor.

Yapay zekâ ile başlık ve abstract'tan üretildi; tam metin okunmaz.

ÇıkarımlarUygulamada
Ana noktalarUygulamada
Makaleye SorUygulamada

Devamı Pofolia uygulamasında

Çıkarımlar, ana noktalar ve makaleye soru sorma; ilgi alanına göre her gün yeni özetler. Ücretsiz.

Web'de giriş yaparak aç

Alan: Yapay Zeka

Artificial IntelligenceComputer Science