One Anchor for All: Unified Multilingual and Multimodal Safety Alignment for LVLMs Authors: Enyi Shi, Fei Shen, Chuancheng Shi, Linxia Zhu, Shuyi Miao, Jinhui Tang, Tat-Seng Chua | Published: 2026-07-30 プロンプトインジェクション倫理的考慮安全性調整手法 2026.07.30 文献データベース
A Cross-Architecture Audit of Direction-Based Inference-Time Defences in Vision-Language Models Authors: Xiangyu Yin, Tora Bodin, Rohan Menon, Chih-Hong Cheng | Published: 2026-07-30 モデル性能評価評価手法透かし評価 2026.07.30 文献データベース
Crossing the Margin Cliff: Toward Relearn-Robust LLM Unlearning via Margin Calibration Authors: Xiangyu Yin, Jiaxu Liu, Zhen Chen, Chih-Hong Cheng | Published: 2026-07-30 AIシステムの関係性倫理的考慮透かし評価 2026.07.30 文献データベース
Robust Estimation of Sparse Numerical Vectors under Local Differential Privacy Authors: Puning Zhao, Zhikun Zhang, Shaowei Wang, Sheng Yue, Bangzhou Xin, Tianhang Zheng, Pengfei Zhang, Xiaochun Cao | Published: 2026-07-30 差分プライバシー攻撃効果の評価評価手法 2026.07.30 文献データベース
CHARGE: Leveraging CWE Hierarchies for Hardware Security SystemVerilog Assertion Generation Authors: Xiao Tan, Cynthia Sturton | Published: 2026-07-30 脆弱性管理評価手法透かし評価 2026.07.30 文献データベース
Revisiting the Adversarial Robustness of Graph-Based Traffic Forecasting Authors: Qingzhao Zhang | Published: 2026-07-30 ポイズニング敵対的学習敵対的攻撃評価 2026.07.30 文献データベース
On-Policy Distillation for LLM Safety: A Routing Approach to Template-Robust Realignment Authors: Yongjian Guo, Wanlun Ma, Lingyu Shen, Xi Xiao, Sheng Wen | Published: 2026-07-29 AIシステムの関係性モデル性能評価倫理的考慮 2026.07.29 文献データベース
MemSecBench: Tracking Agent Memory Poisoning from Persistence to Consequence and Repair Authors: Xuanze Chen, Xukang Xie, Wentao Fu, Jiajun Zhou, Shanqing Yu, Qi Xuan | Published: 2026-07-29 毒性攻撃に特化した内容評価手法透かし 2026.07.29 文献データベース
AgentSnare: Learning to Delay, Divert, and Defuse Autonomous Penetration Agents Authors: Ruoyu Wang, Heng Zhao, Renjie Wu, Mengnan Zhao, Zhixuan Chu, Wanyu Lin, Tianhang Zheng | Published: 2026-07-29 倫理的考慮攻撃効果の評価透かし評価 2026.07.29 文献データベース
Defending Against Backdoor Attacks via Alignment Checking in Model-Contrastive Federated Learning Authors: Hongliang Zhang, Zhongyuan Yu, Guijuan Wang, Tianqing He, Wenshuo Ma, Xiaosong Zhang, Jiguo Yu | Published: 2026-07-29 トリガーの検知バックドアモデルの検知モデル性能評価 2026.07.29 文献データベース