Inherited Circuits, Learned Semantics: How Fine-Tuning Creates Evasion Vulnerabilities Invisible to Standard Evaluation Authors: Ryan Fetterman | Published: 2026-06-25 プロンプトリーキングロバスト分類検出手法の分析 2026.06.25 文献データベース
ShareLock: A Stealthy Multi-Tool Threshold Poisoning Attack Against MCP Authors: Liwei Liu, Tianzhu Han, Zijian Liu, Zishu Dong, Na Ruan | Published: 2026-06-25 エージェント操作手法ツール使用分析プロンプトリーキング 2026.06.25 文献データベース
A Deterministic Control Plane for LLM Coding Agents Authors: Padmaraj Madatha | Published: 2026-06-25 インダイレクトプロンプトインジェクションエージェント操作手法データ保護 2026.06.25 文献データベース
MIRROR: Novelty-Constrained Memory-Guided MCTS Red-Teaming for Agentic RAG Authors: Inderjeet Singh, Andrés Murillo, Motoyoshi Sekiya, Yuki Unno, Junichi Suga | Published: 2026-06-25 RAGへのポイズニング攻撃データセット評価脆弱性評価手法 2026.06.25 文献データベース
DroidBreaker: Practical and Functional Problem-Space Attacks on Machine-Learning Android Malware Detectors Authors: Christian Scano, Diego Soi, Angelo Sotgiu, Luca Demetrio, Davide Maiorca, Giorgio Giacinto, Fabio Roli, Battista Biggio | Published: 2026-06-25 APK評価手法ポイズニング透かし設計 2026.06.25 文献データベース
Agents That Know Too Much: A Data-Centric Survey of Privacy in LLM Agents Authors: Nada Lahjouji, Ashwin Gerard Colaco | Published: 2026-06-25 インダイレクトプロンプトインジェクションデータプライバシー評価プライバシー保護データマイニング 2026.06.25 文献データベース
Empirical Software Engineering TerraProbe: A Layered-Oracle Framework for Detecting Deceptive Fixes in LLM-Assisted Terraform Authors: Manar Alsaid, Chimdumebi Nebolisa, Faris Abbas | Published: 2026-06-25 バグ修正手法脅威モデリング脆弱性評価手法 2026.06.25 文献データベース
Adversarial Diffusion Across Modalities: A Fusion Survey of Attacks, Defenses, and Evaluation for Text, Vision, and Vision-Language Models Authors: Abrar Alotaibi, Moataz Ahmed | Published: 2026-06-25 LLMの安全機構の解除データ生成手法モデルDoS 2026.06.25 文献データベース
Adaptive Evaluation of Out-of-Band Defenses Against Prompt Injection in LLM Agents Authors: Praneeth Narisetty, Shiva Nagendra Babu Kore, Uday Kumar Reddy Kattamanchi, Jayaram Kumarapu | Published: 2026-06-25 インダイレクトプロンプトインジェクションエージェント操作手法透かし攻撃 2026.06.25 文献データベース
Detect, Unlearn, Restore: Defending Text Summarization Models Against Data Poisoning Authors: Poojitha Thota, Shirin Nilizadeh | Published: 2026-06-24 データセットの影響データ毒性攻撃ポイズニング 2026.06.24 文献データベース