MASCing: Configurable Mixture-of-Experts Behavior via Activation Steering Masks Authors: Jona te Lintelo, Lichao Wu, Marina Krček, Sengim Karayalçin, Stjepan Picek | Published: 2026-04-30 Indirect Prompt InjectionGeneralization PerformanceLarge Language Model 2026.04.30 2026.05.02 Literature Database
VOW: Verifiable and Oblivious Watermark Detection for Large Language Models Authors: Xiaokun Luan, Yihao Zhang, Pengcheng Su, Feiran Lei, Meng Sun | Published: 2026-04-30 Digital Watermarking for Generative AIEvaluation MethodWatermarking Technology 2026.04.30 2026.05.02 Literature Database
Low Rank Adaptation for Adversarial Perturbation Authors: Han Liu, Shanghao Shi, Yevgeniy Vorobeychik, Chongjie Zhang, Ning Zhang | Published: 2026-04-30 Generalization Performance低ランク敵対的攻撃Adversarial Learning 2026.04.30 2026.05.02 Literature Database
Security Attack and Defense Strategies for Autonomous Agent Frameworks: A Layered Review with OpenClaw as a Case Study Authors: Luyao Xu, Xiang Chen | Published: 2026-04-30 Indirect Prompt InjectionAttack Chain Analysis自律エージェントセキュリティ 2026.04.30 2026.05.02 Literature Database
AdaBFL: Multi-Layer Defensive Adaptive Aggregation for Bzantine-Robust Federated Learning Authors: Zehui Tang, Yuchen Liu, Feihu Huang | Published: 2026-04-30 Trigger DetectionByzantine ResilienceAdversarial Learning 2026.04.30 2026.05.02 Literature Database
Toward Autonomous SOC Operations: End-to-End LLM Framework for Threat Detection, Query Generation, and Resolution in Security Operations Authors: Md Hasan Saju, Akramul Azim | Published: 2026-04-30 LLM Performance EvaluationData CollectionModel Ensemble 2026.04.30 2026.05.02 Literature Database
REBENCH: A Procedural, Fair-by-Construction Benchmark for LLMs on Stripped-Binary Types and Names (Extended Version) Authors: Jun Yeon Won, Xin Jin, Shiqing Ma, Zhiqiang Lin | Published: 2026-04-30 LLM Performance EvaluationPrompt InjectionPrompt leaking 2026.04.30 2026.05.02 Literature Database
PRAG End-to-End Privacy-Preserving Retrieval-Augmented Generation Authors: Zhijun Li, Minghui Xu, Huayi Qi, Wenxuan Yu, Tingchuang Zhang, Qiao Zhang, GuangYong Shang, Zhen Ma, Xiuzhen Cheng | Published: 2026-04-29 RAGPoisoning attack on RAGPrivacy Protection Method 2026.04.29 2026.05.01 Literature Database
SafeReview: Defending LLM-based Review Systems Against Adversarial Hidden Prompts Authors: Yuan Xin, Yixuan Weng, Minjun Zhu, Ying Ling, Chengwei Qin, Michael Hahn, Michael Backes, Yue Zhang, Linyi Yang | Published: 2026-04-29 LLM Performance EvaluationPrompt InjectionPrompt validation 2026.04.29 2026.05.01 Literature Database
Quantamination: Dynamic Quantization Leaks Your Data Across the Batch Authors: Hanna Foerster, Ilia Shumailov, Cheng Zhang, Yiren Zhao, Jamie Hayes, Robert Mullins | Published: 2026-04-29 Privacy Loss AnalysisPrompt leakingDetection of Model Extraction Attacks 2026.04.29 2026.05.01 Literature Database