Literature Database

Representation Matters: An Empirical Study of Program Representations for LLM Vulnerability Reasoning

Authors: Andrew Stoltman, Johnathan Tang, Haipeng Cai | Published: 2026-06-24
Prompt Injection
Prompt leaking
Vulnerability Assessment Method

Decoupling Reconnaissance and Exploitation: Measuring the Capability Boundaries of LLM-Based Web Penetration Testing

Authors: Liwei Yu, Shuo Li, Ming Zhou, Ge Chu, Yan Guo | Published: 2026-06-24
Disabling Safety Mechanisms of LLM
エージェント設計
自動化ペネトレーションテスト

Privacy-Preserving RAG via Multi-Agent Semantic Rewriting: Achieving Confidentiality Without Compromising Contextual Fidelity

Authors: Yuanhe Zhao, Tianyu Zhang, Huafei Xing, Derek F. Wong, Jianbin Li, Tao Fang | Published: 2026-06-23
RAG
Indirect Prompt Injection
Privacy-Preserving Data Mining

Themis: An explainable AI-enabled framework for Reinforcement Learning with Human Feedback

Authors: Andreas Chouliaras, Luke Connolly, Dimitris Chatzpoulos | Published: 2026-06-23
XAI (Explainable AI)
Alignment
エージェント設計

AdversaBench: Automated LLM Red-Teaming with Multi-Judge Confirmation and Cross-Model Transferability

Authors: Khanak Khandelwal | Published: 2026-06-23
Data Generation Method
Prompt validation
自動化ペネトレーションテスト

LLMs Prompted for Legal Context Object More: Overrefusal from Small On-Premises LLMs in Criminal Legal Context

Authors: Anastasiia Kucherenko, François Brouchoud, Dimitri Percia David, Andrei Kucharavy | Published: 2026-06-23
Relationship of AI Systems
Prompt Injection
文献レビュー

Poster: Exploring the Limits of Audio-Based Detection of Turkish Phone Call Scams

Authors: Arda Eren, Micheal Cheung, Youqian Zhang, Grace Ngai, Eugene Yujun Fu | Published: 2026-06-23
データセットの影響
マルチモーダル安全性
Resource Scarcity Issues

Red-Teaming the Agentic Red-Team

Authors: Dario Pasquini, Michal Bazyli, Taras Fedynyshyn, Artem Sorokin | Published: 2026-06-23
Indirect Prompt Injection
エージェント操作手法
脅威モデリング自動化

PHANTOM: A Large-Scale Dataset of Multimodal Adversarial Attacks for Vision-Language Models

Authors: Simone Gallivanone, Hossein Khodadadi, Mauro Dore, Mauro Medda, Nicola Franco | Published: 2026-06-23
Dataset Applicability
Robustness
Large Language Model

AutoSpec: Safety Rule Evolution for LLM Agents via Inductive Logic Programming

Authors: Pingchuan Ma, Zhaoyu Wang, Zimo Ji, Yuguang Zhou, Zhantong Xue, Zongjie Li, Shuai Wang, Xiaoqin Zhang | Published: 2026-06-23
ILPとCEGISの統合
LLM Application
Automated Vulnerability Remediation