文献データベース

Understanding Overfitting in Adversarial Training via Kernel Regression

Authors: Teng Zhang, Kang Li | Published: 2023-04-13 | Updated: 2023-04-19
ウォーターマーキング
ロバスト性
正則化

Exploiting Logic Locking for a Neural Trojan Attack on Machine Learning Accelerators

Authors: Hongye Xu, Dongfang Liu, Cory Merkel, Michael Zuzak | Published: 2023-04-12 | Updated: 2023-04-14
DNN IP保護手法
ウォーターマーキング
バックドア攻撃

Zero-Knowledge Proof-based Practical Federated Learning on Blockchain

Authors: Zhibo Xing, Zijian Zhang, Meng Li, Jiamou Liu, Liehuang Zhu, Giovanni Russello, Muhammad Rizwan Asghar | Published: 2023-04-12 | Updated: 2023-04-24
ウォーターマーキング
セキュリティ分析
プライバシー手法

RRHF: Rank Responses to Align Language Models with Human Feedback without tears

Authors: Zheng Yuan, Hongyi Yuan, Chuanqi Tan, Wei Wang, Songfang Huang, Fei Huang | Published: 2023-04-11 | Updated: 2023-10-07
アライメント
報酬メカニズム設計
強化学習最適化

Privacy-Preserving Matrix Factorization for Recommendation Systems using Gaussian Mechanism

Authors: Sohan Salahuddin Mugdho, Hafiz Imtiaz | Published: 2023-04-11
ウォーターマーキング
プライバシー分析
プライバシー手法

Multi-step Jailbreaking Privacy Attacks on ChatGPT

Authors: Haoran Li, Dadi Guo, Wei Fan, Mingshi Xu, Jie Huang, Fanpu Meng, Yangqiu Song | Published: 2023-04-11 | Updated: 2023-11-01
LLMセキュリティ
プライバシー分析
プロンプトインジェクション

RecUP-FL: Reconciling Utility and Privacy in Federated Learning via User-configurable Privacy Defense

Authors: Yue Cui, Syed Irfan Ali Meerza, Zhuohang Li, Luyang Liu, Jiaxin Zhang, Jian Liu | Published: 2023-04-11
トレードオフ分析
プライバシー手法
ポイズニング

Balancing Privacy and Performance for Private Federated Learning Algorithms

Authors: Xiangjian Hou, Sarit Khirirat, Mohammad Yaqub, Samuel Horvath | Published: 2023-04-11 | Updated: 2023-08-18
プライバシー手法
ポイズニング
最適化手法

Gradient-based Uncertainty Attribution for Explainable Bayesian Deep Learning

Authors: Hanjing Wang, Dhiraj Joshi, Shiqiang Wang, Qiang Ji | Published: 2023-04-10
DNN IP保護手法
不確実性マップ
自己注意メカニズム

Reinforcement Learning-Based Black-Box Model Inversion Attacks

Authors: Gyojin Han, Jaehyun Choi, Haeil Lee, Junmo Kim | Published: 2023-04-10
DNN IP保護手法
プライバシー手法
生成モデルの課題