Reasoning as a Double-Edged Sword: Architecture and Cross-Stage Robustness in Vision-Language-Action Models Authors: Tuan Duong Trinh, Naveed Akhtar, Basim Azam | Published: 2026-07-20 モデル性能評価攻撃戦略分析攻撃検出 2026.07.20 文献データベース
Dynamic Defense Profiling Enables Cognitive Jailbreak of Text-to-Image Models Authors: Dongdong Yang, Deyue Zhang, Zhao Liu, Zonghao Ying, Wenzhuo Xu, Jiankai Jin, Xiangzheng Zhang, Quanchen Zou | Published: 2026-07-20 プロンプトリーキングモデル性能評価敵対的攻撃手法 2026.07.20 文献データベース
Detection, Attribution, Narration: An End-to-End Pipeline for Explainable Money Mule Identification Authors: Yuge Zhang, Yuanxing Zhang, Yichao Jin, Khairul Amsyar Mohd Razis, Nicholas Qi An Choo, Kai Yin Anders Wong, Xinyan Tang, Kenneth Zhu Ke, Wee Keong Dennis Lee, Jingyuan Zhao | Published: 2026-07-20 インダイレクトプロンプトインジェクションモデル性能評価特徴重要度分析 2026.07.20 文献データベース
(A)iSpy: Parasitic Trojans for Machine Learning Infrastructure Authors: Habibur Rahaman, Qipan Xu, Zafaryab Haider, Prabuddha Chakraborty, Swarup Bhunia, Fnu Suya | Published: 2026-07-20 トリガーの検知バックドアモデルの検知攻撃戦略分析 2026.07.20 文献データベース
DecoyFace: Beyond Obfuscation via Controllable and Imperceptible Identity Misdirection for Privacy-Preserving Face Recognition Authors: Zhihan Ren, Lijun He, Xinyao Wang, Xinzhu Fu, Fan Li | Published: 2026-07-20 データプライバシー管理データ保護手法機械学習のプライバシー保護 2026.07.20 文献データベース
Pretraining Data Can Be Poisoned through Computational Propaganda Authors: Victoria Graf, Hannaneh Hajishirzi, Noah A. Smith, David Kohlbrenner, Kyle Lo | Published: 2026-07-16 データセットの問題データセットの影響ポイズニング 2026.07.16 文献データベース
Beyond Success Rate: Cost-Aware Evaluation of Offensive and Defensive Security Agents Authors: Paul Kassianik, Blaine Nelson, Yaron Singer | Published: 2026-07-16 コスト管理リソース消費分析攻撃検出手法 2026.07.16 文献データベース
When Words Are Safe But Actions Kill: Probing Physical Danger Beyond Text Safety in Hidden-State Risk Space Authors: Weimeng Wang, Ziqiang Wang, Zihang Zhan, Chuanpu Fu, Qi Li, Ke Xu | Published: 2026-07-16 データセットの影響モデル評価手法評価基準 2026.07.16 文献データベース
DataShield: Uncovering Risky Fine-Tuning Data Across LLMs Through Consensus Subspace Alignment Authors: Zefeng Wu, Weiwei Qi, Jielong Chen, Tianhang Zheng, Di Hong, Chaochao Lu, Liang He, Zhan Qin, Kui Ren | Published: 2026-07-16 アライメントデータセットの影響リスク評価手法 2026.07.16 文献データベース
Random Logit Scaling: Defending Deep Neural Networks Against Black-Box Score-Based Adversarial Example Attacks Authors: Hamid Dashtbani, Mehdi Dousti Gandomani, AmirMahdi Sadeghzadeh | Published: 2026-07-16 攻撃手法の説明敵対的学習脅威モデル 2026.07.16 文献データベース