文献データベース

Empirical Analysis of Evasion and Poisoning Against Malware Data Drift Detection

Authors: Mingyue Yang, David Lie, Nicolas Papernot | Published: 2026-08-04
トリガーの検知
バックドア攻撃
マルウェア検出シナリオ

A Security-Oriented Lifecycle Model for Large Language Model Systems

Authors: Eleftherios Batzolis, George Drosatos, Vassilis Katsouros, Konstantinos Rantos | Published: 2026-08-04
AIシステムの関係性
フレームワークサポート
リスクとメカニズム

DiagChain: A Diagnostic Benchmark for Evaluating LLM Agents on Evidence-Grounded Attack Chain Reconstruction

Authors: Xuyang Liu, Yibin Han, Zhenwei Zhang, Kai Chang, Zhiwei Xu, Tian Qiu, Weixian Deng, Jiabao Gao, Xiaolin Peng, Hai Wan, Xibin Zhao | Published: 2026-08-04
イベント識別
攻撃シナリオ分析
攻撃計画手法

WeClawArena: An Auditable Sandbox and Benchmark for Cross-User Agents Collaboration and Security in Human-Centered Agent Networks

Authors: Prince Zizhuang Wang, Aojie Yuan, Haiyue Zhang, Xiyang Hu, Yue Zhao, Shuli Jiang | Published: 2026-08-04
タスク設計
協力体制
文献レビュー

SkillSentry: Adaptive Honey Worlds for Dynamic Safety Testing of Agent Skills

Authors: Nizhang Li, Zonghao Ying, Xiangfan Wu, Zonglei Jing, Xixun Lin, Hao Zhang, Wenxin Zhang, Jiaye Lin, Quanchen Zou, Xiangzheng Zhang | Published: 2026-08-04
インダイレクトプロンプトインジェクション
マルウェア検出シナリオ
動的分析

Test-Time Scaling for Safe Text-Guided Image Generation via Intermediate Clean Estimates

Authors: Jinya Sakurai, Shueicheng Yan, Xun Xu | Published: 2026-08-04
データセットの多様性
透かし手法
透かし技術

Noise-Aware Shrinkage for Differentially Private Zeroth-Order Fine-Tuning of Large Language Models

Authors: Lele Zheng, Weifeng Kong, Xinyi Zhang, Ke Cheng, Tao Zhang, Yulong Shen | Published: 2026-08-04
文献レビュー
透かし手法
透かし技術

ShielDroid: A Hybrid Approach Integrating Machine and Deep Learning for Android Malware Detection

Authors: Md Faisal Ahmed, Zarin Tasnim Biash, Abu Raihan Shakil, Ahmed Ann Noor Ryen, Arman Hossain, Faisal Bin Ashraf, Muhammad Iqbal Hossain | Published: 2026-08-04
マルウェア検出シナリオ
動的分析
特徴選択手法

Structure-Aware Robust Fine-Tuning: Defending Vision-Language-Action Robots Against Physical Attention Hijacking

Authors: Jinquan Zhang, Dongfu Yin, Run Yang, Yufeng Yan, Zhen Tian, F. Richard Yu | Published: 2026-08-04
敵対的攻撃
防御手法
防御手法の効果分析

Adversarial Stress Testing of Role-Playing Language Agents using Multi-Agent Evaluation

Authors: Saqib Shouqi, Abdullah Nazly, Januki Wanniarachchi, Ravisha De Alwis | Published: 2026-08-04
インダイレクトプロンプトインジェクション
倫理基準遵守
評価メトリクス