ToxScreen: Detecting Whether an LLM Has Been Poisoned Authors: Anthony Hughes, Nicole Xing, Collin Francel, Andy Kim, Andrew Draganov | Published: 2026-07-29 RAGへのポイズニング攻撃バックドアモデルの検知毒性攻撃に特化した内容 2026.07.29 文献データベース
Forecasting Trajectory-Level Safety Risks in Black-Box Multi-Turn Interactions Authors: Shi Lin, Peng Qian, Dinghao Liu, Renjie Sun, Sifan Wu, Dezhang Kong, Chenpei Wang, Xun Wang | Published: 2026-07-29 プロンプトリーキングリスク評価早期検出手法 2026.07.29 文献データベース
A First Look at Coding Agents’ Compliance with AI Contribution Rules in Open-Source Communities Authors: Wenhao Yang, Runzhi He, Minghui Zhou | Published: 2026-07-29 AIシステムの関係性リスク管理倫理的ガイドライン遵守 2026.07.29 文献データベース
SecRespond: Benchmarking AI Agents for Real-World Post-Compromise Incident Response Authors: Lehan Wang, Boli Chen, Ruixue Ding, Pengjun Xie, Jinwei Huang, Zhendong Liu, Shuo Wang, Tao Lei, Xin Ouyang, Xiaomeng Li | Published: 2026-07-29 リスク評価脆弱性管理透かし 2026.07.29 文献データベース
Physically Real-time Infrared Attack against Optical Flow Estimation Networks Authors: Shen You, Wei Jiang, Jiarui Liu, Yijian Ye, Qiuzhen Lin, Xiangtao Li, Ka-Chun Wong | Published: 2026-07-29 敵対的攻撃評価物理的敵対攻撃透かし 2026.07.29 文献データベース
FakeIDet3-DB: Refining Digital Attacks and Patch Extraction for Secure ID Benchmarking Authors: Muñoz-Haro Javier, Teruel Andres, Tolosana Ruben, DeAlcala Daniel, Vera-Rodriguez Ruben, Morales Aythami, Fierrez Julian | Published: 2026-07-29 データセット評価ディープフェイクの検知透かし評価 2026.07.29 文献データベース
Borrowed Strength: Best-of-N Search over a Code EncodingBreaks Self-Check Jailbreak Defenses Authors: Haoyu Zhang, Shibo Zheng, Xiangchen Guan, Zhuoxi Wang, Zijian Xiao, Mohammad Zandsalimy, Shanu Sushmita | Published: 2026-07-29 大規模言語モデル攻撃効果の評価透かし評価 2026.07.29 文献データベース
Guarding Organizations Against Malware Risk: A Novel Graph-Based Malware Detection Method Authors: Yinan Gao, Jiarong Xu, Xiaohang Zhao, Xiao Fang | Published: 2026-07-29 プログラムグラフ解析マルウェア分類モデルアーキテクチャ 2026.07.29 文献データベース
Recover, Decode, Reguard: Guard-Agnostic Defense Amplification againstEncoded VLM Jailbreaks Authors: Haoyu Zhang, Zhuoxi Wang, Shibo Zheng, Zijian Xiao, Xiangchen Guan, Mohammad Zandsalimy, Shanu Sushmita | Published: 2026-07-29 プロンプトインジェクション大規模言語モデル透かし評価 2026.07.29 文献データベース
FAS-R1: A Unified Multi-Task MLLM for Reasoning Face Anti-Spoofing Authors: Hongyang Wang, Yichen Shi, Hongrui Li, Yiru Huo, Jun Feng, Zitong Yu | Published: 2026-07-29 AIシステムの関係性モデル性能評価倫理的考慮 2026.07.29 文献データベース