報酬メカニズム設計

Enhanced Adversarial Strategically-Timed Attacks against Deep Reinforcement Learning

Authors: Chao-Han Huck Yang, Jun Qi, Pin-Yu Chen, Yi Ouyang, I-Te Danny Hung, Chin-Hui Lee, Xiaoli Ma | Published: 2020-02-20
報酬メカニズム設計
脆弱性予測
防御手法

Pseudo Random Number Generation: a Reinforcement Learning approach

Authors: Luca Pasqualini, Maurizio Parton | Published: 2019-12-15
データ生成
報酬メカニズム設計
深層強化学習

Contextual Bandits with Random Projection

Authors: Xiaotian Yu | Published: 2019-03-20
オンライン意思決定
報酬メカニズム設計
高次元データ処理