LLM Performance Evaluation

Superficial Safety Alignment Hypothesis

Authors: Jianwei Li, Jung-Eun Kim | Published: 2024-10-07

Safety Alignment

2024.10.07 2025.05.27

Literature Database

DiDOTS: Knowledge Distillation from Large-Language-Models for Dementia Obfuscation in Transcribed Speech

Authors: Dominika Woszczyk, Soteris Demetriou | Published: 2024-10-05

LLM Performance Evaluation

Privacy Protection

2024.10.05 2025.05.27

Literature Database

A Watermark for Black-Box Language Models

Authors: Dara Bahri, John Wieting, Dana Alon, Donald Metzler | Published: 2024-10-02

LLM Performance Evaluation

Watermarking

Watermark Evaluation

2024.10.02 2025.05.27

Literature Database

PathSeeker: Exploring LLM Security Vulnerabilities with a Reinforcement Learning-Based Jailbreak Approach

Authors: Zhihao Lin, Wei Ma, Mingyi Zhou, Yanjie Zhao, Haoyu Wang, Yang Liu, Jun Wang, Li Li | Published: 2024-09-21 | Updated: 2024-10-03

LLM Performance Evaluation

Prompt Injection

2024.09.21 2025.05.27

Literature Database

CLNX: Bridging Code and Natural Language for C/C++ Vulnerability-Contributing Commits Identification

Authors: Zeqing Qin, Yiwei Wu, Lansheng Han | Published: 2024-09-11

LLM Performance Evaluation

Program Analysis

Prompt Injection

2024.09.11 2025.05.27

Literature Database

DrLLM: Prompt-Enhanced Distributed Denial-of-Service Resistance Method with Large Language Models

Authors: Zhenyu Yin, Shang Liu, Guangyuan Xu | Published: 2024-09-11 | Updated: 2025-01-13

DDoS Attack Detection

LLM Performance Evaluation

Prompt Injection

2024.09.11 2025.05.27

Literature Database

LLM-Enhanced Software Patch Localization

Authors: Jinhong Yu, Yi Chen, Di Tang, Xiaozhong Liu, XiaoFeng Wang, Chen Wu, Haixu Tang | Published: 2024-09-10 | Updated: 2024-09-13

LLM Performance Evaluation

Understanding Commit Content

Evaluation Method

2024.09.10 2025.05.27

Literature Database

Using Large Language Models for Template Detection from Security Event Logs

Authors: Risto Vaarandi, Hayretdin Bahsi | Published: 2024-09-08 | Updated: 2025-04-14

LLM Performance Evaluation

Algorithm

Evaluation Method

2024.09.08 2025.05.27

Literature Database

RACONTEUR: A Knowledgeable, Insightful, and Portable LLM-Powered Shell Command Explainer

Authors: Jiangyi Deng, Xinfeng Li, Yanjiao Chen, Yijie Bai, Haiqin Weng, Yan Liu, Tao Wei, Wenyuan Xu | Published: 2024-09-03

LLM Performance Evaluation

Cybersecurity

Prompt Injection

2024.09.03 2025.05.27

Literature Database

The Dark Side of Human Feedback: Poisoning Large Language Models via User Inputs

Authors: Bocheng Chen, Hanqing Guo, Guangjing Wang, Yuanda Wang, Qiben Yan | Published: 2024-09-01

LLM Performance Evaluation

Prompt Injection

Poisoning

2024.09.01 2025.05.27

Literature Database