Trade-Off Between Safety And Usability

SoK: Evaluating Jailbreak Guardrails for Large Language Models

Authors: Xunguang Wang, Zhenlan Ji, Wenxuan Wang, Zongjie Li, Daoyuan Wu, Shuai Wang | Published: 2025-06-12

Prompt Injection

脱獄攻撃手法

2025.06.12 2025.06.14

Literature Database

Authors: Madhur Jindal, Hari Shrawgi, Parag Agrawal, Sandipan Dandapat | Published: 2025-04-28

User Identification System

Large Language Model

Trade-Off Between Safety And Usability

2025.04.28 2025.05.27

Literature Database

Authors: Xuandong Zhao, Will Cai, Tianneng Shi, David Huang, Licong Lin, Song Mei, Dawn Song | Published: 2025-03-05 | Updated: 2025-06-12

Prompt Injection

Robustness Improvement Method

Trade-Off Between Safety And Usability

2025.03.05 2025.06.14

Literature Database