Inherited Circuits, Learned Semantics: How Fine-Tuning Creates Evasion Vulnerabilities Invisible to Standard Evaluation Authors: Ryan Fetterman | Published: 2026-06-25 Prompt leakingRobust ClassificationAnalysis of Detection Methods 2026.06.25 2026.06.27 Literature Database
ShareLock: A Stealthy Multi-Tool Threshold Poisoning Attack Against MCP Authors: Liwei Liu, Tianzhu Han, Zijian Liu, Zishu Dong, Na Ruan | Published: 2026-06-25 エージェント操作手法ツール使用分析Prompt leaking 2026.06.25 2026.06.27 Literature Database
A Deterministic Control Plane for LLM Coding Agents Authors: Padmaraj Madatha | Published: 2026-06-25 Indirect Prompt Injectionエージェント操作手法Data Protection 2026.06.25 2026.06.27 Literature Database
MIRROR: Novelty-Constrained Memory-Guided MCTS Red-Teaming for Agentic RAG Authors: Inderjeet Singh, Andrés Murillo, Motoyoshi Sekiya, Yuki Unno, Junichi Suga | Published: 2026-06-25 Poisoning attack on RAGDataset evaluationVulnerability Assessment Method 2026.06.25 2026.06.27 Literature Database
DroidBreaker: Practical and Functional Problem-Space Attacks on Machine-Learning Android Malware Detectors Authors: Christian Scano, Diego Soi, Angelo Sotgiu, Luca Demetrio, Davide Maiorca, Giorgio Giacinto, Fabio Roli, Battista Biggio | Published: 2026-06-25 APK評価手法PoisoningWatermark Design 2026.06.25 2026.06.27 Literature Database
Agents That Know Too Much: A Data-Centric Survey of Privacy in LLM Agents Authors: Nada Lahjouji, Ashwin Gerard Colaco | Published: 2026-06-25 Indirect Prompt InjectionData Privacy AssessmentPrivacy-Preserving Data Mining 2026.06.25 2026.06.27 Literature Database
Empirical Software Engineering TerraProbe: A Layered-Oracle Framework for Detecting Deceptive Fixes in LLM-Assisted Terraform Authors: Manar Alsaid, Chimdumebi Nebolisa, Faris Abbas | Published: 2026-06-25 バグ修正手法Threat modelingVulnerability Assessment Method 2026.06.25 2026.06.27 Literature Database
Adversarial Diffusion Across Modalities: A Fusion Survey of Attacks, Defenses, and Evaluation for Text, Vision, and Vision-Language Models Authors: Abrar Alotaibi, Moataz Ahmed | Published: 2026-06-25 Disabling Safety Mechanisms of LLMData Generation MethodModel DoS 2026.06.25 2026.06.27 Literature Database
Adaptive Evaluation of Out-of-Band Defenses Against Prompt Injection in LLM Agents Authors: Praneeth Narisetty, Shiva Nagendra Babu Kore, Uday Kumar Reddy Kattamanchi, Jayaram Kumarapu | Published: 2026-06-25 Indirect Prompt Injectionエージェント操作手法透かし攻撃 2026.06.25 2026.06.27 Literature Database
Detect, Unlearn, Restore: Defending Text Summarization Models Against Data Poisoning Authors: Poojitha Thota, Shirin Nilizadeh | Published: 2026-06-24 データセットの影響データ毒性攻撃Poisoning 2026.06.24 2026.06.26 Literature Database