CHARGE: Leveraging CWE Hierarchies for Hardware Security SystemVerilog Assertion Generation Authors: Xiao Tan, Cynthia Sturton | Published: 2026-07-30 脆弱性管理評価手法透かし評価 2026.07.30 文献データベース
Revisiting the Adversarial Robustness of Graph-Based Traffic Forecasting Authors: Qingzhao Zhang | Published: 2026-07-30 ポイズニング敵対的学習敵対的攻撃評価 2026.07.30 文献データベース
On-Policy Distillation for LLM Safety: A Routing Approach to Template-Robust Realignment Authors: Yongjian Guo, Wanlun Ma, Lingyu Shen, Xi Xiao, Sheng Wen | Published: 2026-07-29 AIシステムの関係性モデル性能評価倫理的考慮 2026.07.29 文献データベース
MemSecBench: Tracking Agent Memory Poisoning from Persistence to Consequence and Repair Authors: Xuanze Chen, Xukang Xie, Wentao Fu, Jiajun Zhou, Shanqing Yu, Qi Xuan | Published: 2026-07-29 毒性攻撃に特化した内容評価手法透かし 2026.07.29 文献データベース
AgentSnare: Learning to Delay, Divert, and Defuse Autonomous Penetration Agents Authors: Ruoyu Wang, Heng Zhao, Renjie Wu, Mengnan Zhao, Zhixuan Chu, Wanyu Lin, Tianhang Zheng | Published: 2026-07-29 倫理的考慮攻撃効果の評価透かし評価 2026.07.29 文献データベース
Defending Against Backdoor Attacks via Alignment Checking in Model-Contrastive Federated Learning Authors: Hongliang Zhang, Zhongyuan Yu, Guijuan Wang, Tianqing He, Wenshuo Ma, Xiaosong Zhang, Jiguo Yu | Published: 2026-07-29 トリガーの検知バックドアモデルの検知モデル性能評価 2026.07.29 文献データベース
ToxScreen: Detecting Whether an LLM Has Been Poisoned Authors: Anthony Hughes, Nicole Xing, Collin Francel, Andy Kim, Andrew Draganov | Published: 2026-07-29 RAGへのポイズニング攻撃バックドアモデルの検知毒性攻撃に特化した内容 2026.07.29 文献データベース
Forecasting Trajectory-Level Safety Risks in Black-Box Multi-Turn Interactions Authors: Shi Lin, Peng Qian, Dinghao Liu, Renjie Sun, Sifan Wu, Dezhang Kong, Chenpei Wang, Xun Wang | Published: 2026-07-29 プロンプトリーキングリスク評価早期検出手法 2026.07.29 文献データベース
A First Look at Coding Agents’ Compliance with AI Contribution Rules in Open-Source Communities Authors: Wenhao Yang, Runzhi He, Minghui Zhou | Published: 2026-07-29 AIシステムの関係性リスク管理倫理的ガイドライン遵守 2026.07.29 文献データベース
SecRespond: Benchmarking AI Agents for Real-World Post-Compromise Incident Response Authors: Lehan Wang, Boli Chen, Ruixue Ding, Pengjun Xie, Jinwei Huang, Zhendong Liu, Shuo Wang, Tao Lei, Xin Ouyang, Xiaomeng Li | Published: 2026-07-29 リスク評価脆弱性管理透かし 2026.07.29 文献データベース