プロンプトインジェクション

Threat Modelling and Risk Analysis for Large Language Model (LLM)-Powered Applications

Authors: Stephen Burabari Tete | Published: 2024-06-16

LLMセキュリティ

プロンプトインジェクション

リスク管理

2024.06.16 2025.04.03

文献データベース

Emerging Safety Attack and Defense in Federated Instruction Tuning of Large Language Models

Authors: Rui Ye, Jingyi Chai, Xiangrui Liu, Yaodong Yang, Yanfeng Wang, Siheng Chen | Published: 2024-06-15

LLMセキュリティ

プロンプトインジェクション

ポイズニング

2024.06.15 2025.04.03

文献データベース

RL-JACK: Reinforcement Learning-powered Black-box Jailbreaking Attack against LLMs

Authors: Xuan Chen, Yuzhou Nie, Lu Yan, Yunshu Mao, Wenbo Guo, Xiangyu Zhang | Published: 2024-06-13

LLMセキュリティ

プロンプトインジェクション

強化学習

2024.06.13 2025.04.03

文献データベース

Efficient Network Traffic Feature Sets for IoT Intrusion Detection

Authors: Miguel Silva, João Vitorino, Eva Maia, Isabel Praça | Published: 2024-06-12

プロンプトインジェクション

モデル性能評価

機械学習手法

2024.06.12 2025.04.03

文献データベース

Dataset and Lessons Learned from the 2024 SaTML LLM Capture-the-Flag Competition

Authors: Edoardo Debenedetti, Javier Rando, Daniel Paleka, Silaghi Fineas Florin, Dragos Albastroiu, Niv Cohen, Yuval Lemberg, Reshmi Ghosh, Rui Wen, Ahmed Salem, Giovanni Cherubin, Santiago Zanella-Beguelin, Robin Schmid, Victor Klemm, Takahiro Miki, Chenhao Li, Stefan Kraft, Mario Fritz, Florian Tramèr, Sahar Abdelnabi, Lea Schönherr | Published: 2024-06-12

LLMセキュリティ

プロンプトインジェクション

防御手法

2024.06.12 2025.04.03

文献データベース

Knowledge Return Oriented Prompting (KROP)

Authors: Jason Martin, Kenneth Yeung | Published: 2024-06-11

LLMセキュリティ

プロンプトインジェクション

攻撃手法

2024.06.11 2025.04.03

文献データベース

LLAMAFUZZ: Large Language Model Enhanced Greybox Fuzzing

Authors: Hongxiang Zhang, Yuyang Rong, Yifeng He, Hao Chen | Published: 2024-06-11 | Updated: 2024-06-13

LLM性能評価

ファジング

プロンプトインジェクション

2024.06.11 2025.04.03

文献データベース

An LLM-Assisted Easy-to-Trigger Backdoor Attack on Code Completion Models: Injecting Disguised Vulnerabilities against Strong Detection

Authors: Shenao Yan, Shen Wang, Yue Duan, Hanbin Hong, Kiho Lee, Doowon Kim, Yuan Hong | Published: 2024-06-10

LLMセキュリティ

バックドア攻撃

プロンプトインジェクション

2024.06.10 2025.04.03

文献データベース

SecureNet: A Comparative Study of DeBERTa and Large Language Models for Phishing Detection

Authors: Sakshi Mahendru, Tejul Pandit | Published: 2024-06-10

LLM性能評価

フィッシング検出

プロンプトインジェクション

2024.06.10 2025.04.03

文献データベース

Safety Alignment Should Be Made More Than Just a Few Tokens Deep

Authors: Xiangyu Qi, Ashwinee Panda, Kaifeng Lyu, Xiao Ma, Subhrajit Roy, Ahmad Beirami, Prateek Mittal, Peter Henderson | Published: 2024-06-10

LLMセキュリティ

プロンプトインジェクション

安全性アライメント

2024.06.10 2025.04.03

文献データベース