PofoliaPofolia ile paylaşıldı

arXiv (Cornell University)· 2017· Ön baskı

Pekiştirmeli Öğrenme Politika Yürütmelerinde Kesintili Olmayan Anormalliklerin Teşhisi

Diagnosing Non-Intermittent Anomalies in Reinforcement Learning Policy Executions (Short Paper)

Schulman, John, Wolski, Filip, Dhariwal, Prafulla, Alec Radford ve diğerleri

Kısa özet

Bir oktokopter RL denetleyicisinin simülasyondan gerçek dünyaya aktarımı, gerçek dünya uçuş sapmasında %100'lük bir artış ortaya çıkardı, ancak yine de 2m güvenlik koridorları içinde kaldı ve gerçek dünya dönüş uçuş modu nedeniyle araç yönelimi önemli ölçüde farklıydı.

Yapay zekâ ile başlık ve abstract'tan üretildi; tam metin okunmaz.

ÇıkarımlarUygulamada
Ana noktalarUygulamada
Makaleye SorUygulamada

Devamı Pofolia uygulamasında

Çıkarımlar, ana noktalar ve makaleye soru sorma; ilgi alanına göre her gün yeni özetler. Ücretsiz.

Web'de giriş yaparak aç

Alan: Yapay Zeka

Artificial IntelligenceComputer Science