PofoliaPofolia ile paylaşıldı

arXiv (Cornell University)· 2018· Ön baskı

Tekrarlayan Dünya Modelleri Politika Evrimini Kolaylaştırır

Recurrent World Models Facilitate Policy Evolution

David Ha, Jürgen Schmidhuber

Kısa özet

Pekiştirmeli öğrenme (RL) ortamlarını modellemek üzere denetimsiz olarak eğitilmiş üretken bir tekrarlayan sinir ağı, evrim yoluyla eğitilen kompakt politikalar için çıkarılan özellikleriyle en gelişmiş sonuçları elde etti.

Yapay zekâ ile başlık ve abstract'tan üretildi; tam metin okunmaz.

ÇıkarımlarUygulamada
Ana noktalarUygulamada
Makaleye SorUygulamada

Devamı Pofolia uygulamasında

Çıkarımlar, ana noktalar ve makaleye soru sorma; ilgi alanına göre her gün yeni özetler. Ücretsiz.

Web'de giriş yaparak aç

Alan: Kalkınma

DevelopmentSocial Sciences