CHARGE: Leveraging CWE Hierarchies for Hardware Security SystemVerilog Assertion Generation Authors: Xiao Tan, Cynthia Sturton | Published: 2026-07-30 Vulnerability ManagementEvaluation MethodWatermark Evaluation 2026.07.30 2026.08.01 Literature Database
Revisiting the Adversarial Robustness of Graph-Based Traffic Forecasting Authors: Qingzhao Zhang | Published: 2026-07-30 PoisoningAdversarial LearningAdversarial Attack Assessment 2026.07.30 2026.08.01 Literature Database
On-Policy Distillation for LLM Safety: A Routing Approach to Template-Robust Realignment Authors: Yongjian Guo, Wanlun Ma, Lingyu Shen, Xi Xiao, Sheng Wen | Published: 2026-07-29 Relationship of AI SystemsModel Performance EvaluationEthical Considerations 2026.07.29 2026.07.31 Literature Database
MemSecBench: Tracking Agent Memory Poisoning from Persistence to Consequence and Repair Authors: Xuanze Chen, Xukang Xie, Wentao Fu, Jiajun Zhou, Shanqing Yu, Qi Xuan | Published: 2026-07-29 Content Specialized for Toxicity AttacksEvaluation MethodWatermark 2026.07.29 2026.07.31 Literature Database
AgentSnare: Learning to Delay, Divert, and Defuse Autonomous Penetration Agents Authors: Ruoyu Wang, Heng Zhao, Renjie Wu, Mengnan Zhao, Zhixuan Chu, Wanyu Lin, Tianhang Zheng | Published: 2026-07-29 Ethical Considerations攻撃効果の評価Watermark Evaluation 2026.07.29 2026.07.31 Literature Database
Defending Against Backdoor Attacks via Alignment Checking in Model-Contrastive Federated Learning Authors: Hongliang Zhang, Zhongyuan Yu, Guijuan Wang, Tianqing He, Wenshuo Ma, Xiaosong Zhang, Jiguo Yu | Published: 2026-07-29 Trigger DetectionBackdoor DetectionModel Performance Evaluation 2026.07.29 2026.07.31 Literature Database
ToxScreen: Detecting Whether an LLM Has Been Poisoned Authors: Anthony Hughes, Nicole Xing, Collin Francel, Andy Kim, Andrew Draganov | Published: 2026-07-29 Poisoning attack on RAGBackdoor DetectionContent Specialized for Toxicity Attacks 2026.07.29 2026.07.31 Literature Database
Forecasting Trajectory-Level Safety Risks in Black-Box Multi-Turn Interactions Authors: Shi Lin, Peng Qian, Dinghao Liu, Renjie Sun, Sifan Wu, Dezhang Kong, Chenpei Wang, Xun Wang | Published: 2026-07-29 Prompt leakingRisk AssessmentEarly Detection Method 2026.07.29 2026.07.31 Literature Database
A First Look at Coding Agents’ Compliance with AI Contribution Rules in Open-Source Communities Authors: Wenhao Yang, Runzhi He, Minghui Zhou | Published: 2026-07-29 Relationship of AI SystemsRisk ManagementCompliance with Ethical Guidelines 2026.07.29 2026.07.31 Literature Database
SecRespond: Benchmarking AI Agents for Real-World Post-Compromise Incident Response Authors: Lehan Wang, Boli Chen, Ruixue Ding, Pengjun Xie, Jinwei Huang, Zhendong Liu, Shuo Wang, Tao Lei, Xin Ouyang, Xiaomeng Li | Published: 2026-07-29 Risk AssessmentVulnerability ManagementWatermark 2026.07.29 2026.07.31 Literature Database