Enhanced Adversarial Strategically-Timed Attacks against Deep Reinforcement Learning Authors: Chao-Han Huck Yang, Jun Qi, Pin-Yu Chen, Yi Ouyang, I-Te Danny Hung, Chin-Hui Lee, Xiaoli Ma | Published: 2020-02-20 報酬メカニズム設計脆弱性予測防御手法 2020.02.20 2025.04.03 文献データベース
Pseudo Random Number Generation: a Reinforcement Learning approach Authors: Luca Pasqualini, Maurizio Parton | Published: 2019-12-15 データ生成報酬メカニズム設計深層強化学習 2019.12.15 2025.04.03 文献データベース
Contextual Bandits with Random Projection Authors: Xiaotian Yu | Published: 2019-03-20 オンライン意思決定報酬メカニズム設計高次元データ処理 2019.03.20 2025.04.03 文献データベース