AIセキュリティポータルbot

CHARGE: Leveraging CWE Hierarchies for Hardware Security SystemVerilog Assertion Generation

Authors: Xiao Tan, Cynthia Sturton | Published: 2026-07-30
脆弱性管理
評価手法
透かし評価

Revisiting the Adversarial Robustness of Graph-Based Traffic Forecasting

Authors: Qingzhao Zhang | Published: 2026-07-30
ポイズニング
敵対的学習
敵対的攻撃評価

On-Policy Distillation for LLM Safety: A Routing Approach to Template-Robust Realignment

Authors: Yongjian Guo, Wanlun Ma, Lingyu Shen, Xi Xiao, Sheng Wen | Published: 2026-07-29
AIシステムの関係性
モデル性能評価
倫理的考慮

MemSecBench: Tracking Agent Memory Poisoning from Persistence to Consequence and Repair

Authors: Xuanze Chen, Xukang Xie, Wentao Fu, Jiajun Zhou, Shanqing Yu, Qi Xuan | Published: 2026-07-29
毒性攻撃に特化した内容
評価手法
透かし

AgentSnare: Learning to Delay, Divert, and Defuse Autonomous Penetration Agents

Authors: Ruoyu Wang, Heng Zhao, Renjie Wu, Mengnan Zhao, Zhixuan Chu, Wanyu Lin, Tianhang Zheng | Published: 2026-07-29
倫理的考慮
攻撃効果の評価
透かし評価

Defending Against Backdoor Attacks via Alignment Checking in Model-Contrastive Federated Learning

Authors: Hongliang Zhang, Zhongyuan Yu, Guijuan Wang, Tianqing He, Wenshuo Ma, Xiaosong Zhang, Jiguo Yu | Published: 2026-07-29
トリガーの検知
バックドアモデルの検知
モデル性能評価

ToxScreen: Detecting Whether an LLM Has Been Poisoned

Authors: Anthony Hughes, Nicole Xing, Collin Francel, Andy Kim, Andrew Draganov | Published: 2026-07-29
RAGへのポイズニング攻撃
バックドアモデルの検知
毒性攻撃に特化した内容

Forecasting Trajectory-Level Safety Risks in Black-Box Multi-Turn Interactions

Authors: Shi Lin, Peng Qian, Dinghao Liu, Renjie Sun, Sifan Wu, Dezhang Kong, Chenpei Wang, Xun Wang | Published: 2026-07-29
プロンプトリーキング
リスク評価
早期検出手法

A First Look at Coding Agents’ Compliance with AI Contribution Rules in Open-Source Communities

Authors: Wenhao Yang, Runzhi He, Minghui Zhou | Published: 2026-07-29
AIシステムの関係性
リスク管理
倫理的ガイドライン遵守

SecRespond: Benchmarking AI Agents for Real-World Post-Compromise Incident Response

Authors: Lehan Wang, Boli Chen, Ruixue Ding, Pengjun Xie, Jinwei Huang, Zhendong Liu, Shuo Wang, Tao Lei, Xin Ouyang, Xiaomeng Li | Published: 2026-07-29
リスク評価
脆弱性管理
透かし