PofoliaPofolia ile paylaşıldı

Journal of Machine Learning Research· 2015Q1· Derleme

Güvenli Pekiştirmeli Öğrenme Üzerine Kapsamlı Bir İnceleme

A comprehensive survey on safe reinforcement learning

Javier García, Fernando Fernández

Kısa özet

Bu inceleme, Güvenli Pekiştirmeli Öğrenme'nin (GPO) iki ana yaklaşımını kategorize eder ve analiz eder: optimallik kriterinin bir güvenlik faktörü ile değiştirilmesi ve harici bilginin veya risk metriğinin dahil edilmesiyle keşif sürecinin değiştirilmesi.

Yapay zekâ ile başlık ve abstract'tan üretildi; tam metin okunmaz.

ÇıkarımlarUygulamada
Ana noktalarUygulamada
Makaleye SorUygulamada

Devamı Pofolia uygulamasında

Çıkarımlar, ana noktalar ve makaleye soru sorma; ilgi alanına göre her gün yeni özetler. Ücretsiz.

Web'de giriş yaparak aç

Alan: Yazılım

SoftwareComputer Science