Red-Teaming Auto Mode: Improving Blocking Classifiers Against Malign Coding Agents Authors: Alex Remedios, Simon Storf, Fabien Roger, John Hughes | Published: 2026-09-17 エージェント評価手法Attack EvaluationAutomated Model Monitoring 2026.09.17 2026.09.19 Literature Database
Securing quantum error correction against misleading advice from AI agents Authors: A. Barış Özgüler | Published: 2026-09-16 エラー解析評価メトリクスQuantum Machine Learning 2026.09.16 2026.09.18 Literature Database
ASLEval: Measuring Privacy Exposure Displacement in LLM Agent Sessions Authors: Guosen Wu, Huizhen Huang, Guoxiong Long, Tao Huang, Chen Hou | Published: 2026-09-16 Data ProtectionData-Driven Vulnerability Assessment評価メトリクス 2026.09.16 2026.09.18 Literature Database
The Illusion of Local Privacy: Confidentiality Boundary Failures in Consumer LLM Serving Systems Authors: Youssef Hamdi Zafan Ibrahim, Muhammad Ikram, Mohammed Khalaf Salama | Published: 2026-09-16 Prompt InjectionPrompt leakingEvaluation Method 2026.09.16 2026.09.18 Literature Database
Beyond Routine Compliance: Cunning Data Cultivates Safety Vigilance in Large Language Models Authors: Youjia Wang, Lin Xu, Yang Sun, Yuxiao Lu, Chengfang Fang, Jie Shi | Published: 2026-09-16 RAGDataset evaluation安全性調整手法 2026.09.16 2026.09.18 Literature Database
Collective Loss of Control in LLM Agent Systems: An Epidemic Account of Mutation, Contagion, and Recovery Authors: Xiangfan Wu, Zonghao Ying, Huiyu Wu, Xing Zheng, Huangsheng Cheng, Xiaorong Shi, Jing Guo | Published: 2026-09-16 制御限界Attack Evaluation評価メトリクス 2026.09.16 2026.09.18 Literature Database
Market Signal Injection: Adversarial Context Manipulation of LLM Pricing Agents Authors: Dohun Lee, Hyunwoo Park | Published: 2026-09-16 Indirect Prompt InjectionPrompt InjectionAttack Evaluation 2026.09.16 2026.09.18 Literature Database
A GAN-Based Framework for Robust DDoS Attack Detection Authors: Makram Chehayeb, Walid Fahs, Amina Rizk, Rida Khatoun, Omran Berjawi | Published: 2026-09-16 CybersecurityTrigger DetectionModel Performance Evaluation 2026.09.16 2026.09.18 Literature Database
BENCHCOMPASS: From Scores to Signals for Training and Harness Decisions in Payment-Domain LLMs Authors: Sijie Dong, Wei Ren, Xuanwei Hu, Jiawei Luo, Zifan Wang, Xiaoyun Feng, Hui Cai, Lyuxin Xue, Peng Lu, Jianshe Li, Xin Zhang, Wei Wu | Published: 2026-09-16 Data-Driven Vulnerability AssessmentAttack Evaluation評価メトリクス 2026.09.16 2026.09.18 Literature Database
PentestChain: A Cost-Aware, MCP-Orchestrated Framework for Automated Penetration Testing with Free-Tier LLMs Authors: Rushabh Vipulkumar Patel, Dipo Dunsin, Mohammed Almaiah, Mohamed Chahine Ghanem | Published: 2026-09-16 コスト意識のあるAICybersecurity評価基準 2026.09.16 2026.09.18 Literature Database