Representation Matters: An Empirical Study of Program Representations for LLM Vulnerability Reasoning Authors: Andrew Stoltman, Johnathan Tang, Haipeng Cai | Published: 2026-06-24 Prompt InjectionPrompt leakingVulnerability Assessment Method 2026.06.24 2026.06.26 Literature Database
Decoupling Reconnaissance and Exploitation: Measuring the Capability Boundaries of LLM-Based Web Penetration Testing Authors: Liwei Yu, Shuo Li, Ming Zhou, Ge Chu, Yan Guo | Published: 2026-06-24 Disabling Safety Mechanisms of LLMエージェント設計自動化ペネトレーションテスト 2026.06.24 2026.06.26 Literature Database
Privacy-Preserving RAG via Multi-Agent Semantic Rewriting: Achieving Confidentiality Without Compromising Contextual Fidelity Authors: Yuanhe Zhao, Tianyu Zhang, Huafei Xing, Derek F. Wong, Jianbin Li, Tao Fang | Published: 2026-06-23 RAGIndirect Prompt InjectionPrivacy-Preserving Data Mining 2026.06.23 2026.06.25 Literature Database
Themis: An explainable AI-enabled framework for Reinforcement Learning with Human Feedback Authors: Andreas Chouliaras, Luke Connolly, Dimitris Chatzpoulos | Published: 2026-06-23 XAI (Explainable AI)Alignmentエージェント設計 2026.06.23 2026.06.25 Literature Database
AdversaBench: Automated LLM Red-Teaming with Multi-Judge Confirmation and Cross-Model Transferability Authors: Khanak Khandelwal | Published: 2026-06-23 Data Generation MethodPrompt validation自動化ペネトレーションテスト 2026.06.23 2026.06.25 Literature Database
LLMs Prompted for Legal Context Object More: Overrefusal from Small On-Premises LLMs in Criminal Legal Context Authors: Anastasiia Kucherenko, François Brouchoud, Dimitri Percia David, Andrei Kucharavy | Published: 2026-06-23 Relationship of AI SystemsPrompt Injection文献レビュー 2026.06.23 2026.06.25 Literature Database
Poster: Exploring the Limits of Audio-Based Detection of Turkish Phone Call Scams Authors: Arda Eren, Micheal Cheung, Youqian Zhang, Grace Ngai, Eugene Yujun Fu | Published: 2026-06-23 データセットの影響マルチモーダル安全性Resource Scarcity Issues 2026.06.23 2026.06.25 Literature Database
Red-Teaming the Agentic Red-Team Authors: Dario Pasquini, Michal Bazyli, Taras Fedynyshyn, Artem Sorokin | Published: 2026-06-23 Indirect Prompt Injectionエージェント操作手法脅威モデリング自動化 2026.06.23 2026.06.25 Literature Database
PHANTOM: A Large-Scale Dataset of Multimodal Adversarial Attacks for Vision-Language Models Authors: Simone Gallivanone, Hossein Khodadadi, Mauro Dore, Mauro Medda, Nicola Franco | Published: 2026-06-23 Dataset ApplicabilityRobustnessLarge Language Model 2026.06.23 2026.06.25 Literature Database
AutoSpec: Safety Rule Evolution for LLM Agents via Inductive Logic Programming Authors: Pingchuan Ma, Zhaoyu Wang, Zimo Ji, Yuguang Zhou, Zhantong Xue, Zongjie Li, Shuai Wang, Xiaoqin Zhang | Published: 2026-06-23 ILPとCEGISの統合LLM ApplicationAutomated Vulnerability Remediation 2026.06.23 2026.06.25 Literature Database