LLM Performance Evaluation

A Watermark for Black-Box Language Models

Authors: Dara Bahri, John Wieting, Dana Alon, Donald Metzler | Published: 2024-10-02

Watermarking

Watermark Evaluation

2024.10.02 2025.05.27

Literature Database

PathSeeker: Exploring LLM Security Vulnerabilities with a Reinforcement Learning-Based Jailbreak Approach

Authors: Zhihao Lin, Wei Ma, Mingyi Zhou, Yanjie Zhao, Haoyu Wang, Yang Liu, Jun Wang, Li Li | Published: 2024-09-21 | Updated: 2024-10-03

LLM Performance Evaluation

Prompt Injection

2024.09.21 2025.05.27

Literature Database

CLNX: Bridging Code and Natural Language for C/C++ Vulnerability-Contributing Commits Identification

Authors: Zeqing Qin, Yiwei Wu, Lansheng Han | Published: 2024-09-11

LLM Performance Evaluation

Program Analysis

Prompt Injection

2024.09.11 2025.05.27

Literature Database

DrLLM: Prompt-Enhanced Distributed Denial-of-Service Resistance Method with Large Language Models

Authors: Zhenyu Yin, Shang Liu, Guangyuan Xu | Published: 2024-09-11 | Updated: 2025-01-13

DDoS Attack Detection

LLM Performance Evaluation

Prompt Injection

2024.09.11 2025.05.27

Literature Database

LLM-Enhanced Software Patch Localization

Authors: Jinhong Yu, Yi Chen, Di Tang, Xiaozhong Liu, XiaoFeng Wang, Chen Wu, Haixu Tang | Published: 2024-09-10 | Updated: 2024-09-13

LLM Performance Evaluation

Understanding Commit Content

Evaluation Method

2024.09.10 2025.05.27

Literature Database

Using Large Language Models for Template Detection from Security Event Logs

Authors: Risto Vaarandi, Hayretdin Bahsi | Published: 2024-09-08 | Updated: 2025-04-14

LLM Performance Evaluation

Algorithm

Evaluation Method

2024.09.08 2025.05.27

Literature Database

RACONTEUR: A Knowledgeable, Insightful, and Portable LLM-Powered Shell Command Explainer

Authors: Jiangyi Deng, Xinfeng Li, Yanjiao Chen, Yijie Bai, Haiqin Weng, Yan Liu, Tao Wei, Wenyuan Xu | Published: 2024-09-03

LLM Performance Evaluation

Cybersecurity

Prompt Injection

2024.09.03 2025.05.27

Literature Database

The Dark Side of Human Feedback: Poisoning Large Language Models via User Inputs

Authors: Bocheng Chen, Hanqing Guo, Guangjing Wang, Yuanda Wang, Qiben Yan | Published: 2024-09-01

LLM Performance Evaluation

Prompt Injection

Poisoning

2024.09.01 2025.05.27

Literature Database

Automatic Pseudo-Harmful Prompt Generation for Evaluating False Refusals in Large Language Models

Authors: Bang An, Sicheng Zhu, Ruiyi Zhang, Michael-Andrei Panaitescu-Liess, Yuancheng Xu, Furong Huang | Published: 2024-09-01

LLM Performance Evaluation

Content Moderation

Prompt Injection

2024.09.01 2025.05.27

Literature Database

LeCov: Multi-level Testing Criteria for Large Language Models

Authors: Xuan Xie, Jiayang Song, Yuheng Huang, Da Song, Fuyuan Zhang, Felix Juefei-Xu, Lei Ma | Published: 2024-08-20

LLM Performance Evaluation

Test Prioritization

Prompt Injection

2024.08.20 2025.05.27

Literature Database