Literature Database

MISLEAD: Manipulating Importance of Selected features for Learning Epsilon in Evasion Attack Deception

Authors: Vidit Khazanchi, Pavan Kulkarni, Yuvaraj Govindarajulu, Manojkumar Parmar | Published: 2024-04-24 | Updated: 2024-05-02

Model Interpretability

Attack Method

Adversarial Training

2024.04.24 2025.05.27

Literature Database

Watch Out for Your Guidance on Generation! Exploring Conditional Backdoor Attacks against Large Language Models

Authors: Jiaming He, Wenbo Jiang, Guanyu Hou, Wenshu Fan, Rui Zhang, Hongwei Li | Published: 2024-04-23 | Updated: 2025-01-08

LLM Security

Backdoor Attack

Poisoning

2024.04.23 2025.05.27

Literature Database

A Customer Level Fraudulent Activity Detection Benchmark for Enhancing Machine Learning Model Research and Evaluation

Authors: Phoebe Jing, Yijing Gao, Xianlong Zeng | Published: 2024-04-23

Watermarking

Data Privacy Assessment

Machine Learning Method

2024.04.23 2025.05.27

Literature Database

Chain of trust: Unraveling references among Common Criteria certified products

Authors: Adam Janovsky, Łukasz Chmielewski, Petr Svenda, Jan Jancar, Vashek Matyas | Published: 2024-04-22 | Updated: 2024-08-19

Dependency Risk Assessment

Evaluation Method

Watermark Evaluation

2024.04.22 2025.05.27

Literature Database

Protecting Your LLMs with Information Bottleneck

Authors: Zichuan Liu, Zefan Wang, Linjie Xu, Jinyu Wang, Lei Song, Tianchun Wang, Chunlin Chen, Wei Cheng, Jiang Bian | Published: 2024-04-22 | Updated: 2024-10-10

LLM Security

Prompt Injection

Compliance with Ethical Guidelines

2024.04.22 2025.05.27

Literature Database

Competition Report: Finding Universal Jailbreak Backdoors in Aligned LLMs

Authors: Javier Rando, Francesco Croce, Kryštof Mitka, Stepan Shabalin, Maksym Andriushchenko, Nicolas Flammarion, Florian Tramèr | Published: 2024-04-22 | Updated: 2024-06-06

LLM Security

Backdoor Attack

Prompt Injection

2024.04.22 2025.05.27

Literature Database

AdvPrompter: Fast Adaptive Adversarial Prompting for LLMs

Authors: Anselm Paulus, Arman Zharmagambetov, Chuan Guo, Brandon Amos, Yuandong Tian | Published: 2024-04-21

LLM Security

Prompt Injection

Prompt Engineering

2024.04.21 2025.05.27

Literature Database

Reliable Model Watermarking: Defending Against Theft without Compromising on Evasion

Authors: Hongyu Zhu, Sichu Liang, Wentao Hu, Fangqi Li, Ju Jia, Shilin Wang | Published: 2024-04-21

Membership Inference

Watermark Robustness

Watermark Evaluation

2024.04.21 2025.05.27

Literature Database

PristiQ: A Co-Design Framework for Preserving Data Security of Quantum Learning in the Cloud

Authors: Zhepeng Wang, Yi Sheng, Nirajan Koirala, Kanad Basu, Taeho Jung, Cheng-Chang Lu, Weiwen Jiang | Published: 2024-04-20

Watermarking

Quantum Framework

Quantum Cryptography Technology

2024.04.20 2025.05.27

Literature Database

Evaluating the Effectiveness of LLMs in Introductory Computer Science Education: A Semester-Long Field Study

Authors: Wenhan Lyu, Yimeng Wang, Tingting, Chung, Yifan Sun, Yixuan Zhang | Published: 2024-04-20 | Updated: 2024-05-03

Data Extraction and Analysis

Human-Centered Computing

Education and Follow-up

2024.04.20 2025.05.27

Literature Database