KBF: Knowledge Boundary as Fingerprint for Language Model and Black-Box API Auditing Authors: Yijia Fang, Yiqing Feng, Bingyu Li, Mingxun Zhou | Published: 2026-05-28 RAGData Extraction and AnalysisModel Architecture 2026.05.28 2026.05.30 Literature Database
SciIntBench: Measuring LLM Compliance with Research Integrity Norms Under Adversarial Framing Authors: Almene De Meran Meguimtsop, Maria Leonor Pacheco, Daniel E. Acuna | Published: 2026-05-28 Disabling Safety Mechanisms of LLMIndirect Prompt InjectionAuthor Contribution 2026.05.28 2026.05.30 Literature Database
Protecting On-Device AI Inference: A Systematic Review of Attacks and Defence Mechanisms Authors: Zisis Tsiatsikas, Alexandros Fakis, Georgios Karopoulos, Vasileios Kouliaridis, Marios Anagnostopoulos | Published: 2026-05-28 Data Protection MethodBackdoor DetectionModel Extraction Attack 2026.05.28 2026.05.30 Literature Database
Provably Secure Agent Guardrail Authors: Benlong Wu, Weiming Zhang, Kejiang Chen, Han Fang, Nenghai Yu | Published: 2026-05-28 LLM SecurityData Protection MethodEfficient Proof System 2026.05.28 2026.05.30 Literature Database
Implicit Identity Technologies for LLMs: Fingerprinting and Watermarking across Datasets, Models, and Generated Content Authors: Bing Liu, Shunping Wang, Yufan Zhu, Xinyi Yu, Jing Huang, Linkang Du, Hongbin Pei, Wei Luo | Published: 2026-05-28 Indirect Prompt InjectionDigital Watermarking for Generative AIAuthor Identification Method 2026.05.28 2026.05.30 Literature Database
Evolving Skill-Structured Attack Memory Enhances LLM Jailbreaking Authors: Junke Zhang, Jianwei Wang, Sishuo Chen, Yizhang He, Qingshuai Feng, Zhengyi Yang | Published: 2026-05-28 LLM SecurityPrompt Injectionメモリ効率化手法 2026.05.28 2026.05.30 Literature Database
Relevance as a Vulnerability: How Web Retrieval Degrades Safety Alignment in LLM Agents Authors: Aditya Nawal, Manit Baser, Mohan Gurusamy | Published: 2026-05-28 Relationship of AI SystemsIndirect Prompt InjectionData Extraction and Analysis 2026.05.28 2026.05.30 Literature Database
SAMD: A Tool for Identifying False Data Injection Scenarios in AI/ML-enabled Medical Devices Authors: Mohammadreza Hallajiyan, Xueren Ge, Athish Pranav Dharmalingam, Gargi Mitra, Shahrear Iqbal, Homa Alemzadeh, Karthik Pattabiraman | Published: 2026-05-28 LLM Securityシナリオベースの悪用Data-Centric Security 2026.05.28 2026.05.30 Literature Database
Blind PRNG Hijacking: An Undetectable Integrity-Preserving Attack Against LLM Watermarking Authors: Ziyang You, Huilong He, Xiaoke Yang, Xuxing Lu | Published: 2026-05-27 LLM SecurityCryptographyWatermark 2026.05.27 2026.05.29 Literature Database
Towards Cybersecurity SuperIntelligence (CSI): What’s the best harness for cybersecurity? Authors: Víctor Mayoral-Vilches, Francesco Balassone, María Sanz-Gómez, Paul Zabalegui Landa, Daniel Sánchez Prieto, Marina Oteiza Álvarez, Davide Quarta, Martin Pinzger | Published: 2026-05-27 LLM SecurityModel ArchitectureComputational Efficiency 2026.05.27 2026.05.29 Literature Database