文献データベース

ToxScreen: Detecting Whether an LLM Has Been Poisoned

Authors: Anthony Hughes, Nicole Xing, Collin Francel, Andy Kim, Andrew Draganov | Published: 2026-07-29
RAGへのポイズニング攻撃
バックドアモデルの検知
毒性攻撃に特化した内容

Forecasting Trajectory-Level Safety Risks in Black-Box Multi-Turn Interactions

Authors: Shi Lin, Peng Qian, Dinghao Liu, Renjie Sun, Sifan Wu, Dezhang Kong, Chenpei Wang, Xun Wang | Published: 2026-07-29
プロンプトリーキング
リスク評価
早期検出手法

A First Look at Coding Agents’ Compliance with AI Contribution Rules in Open-Source Communities

Authors: Wenhao Yang, Runzhi He, Minghui Zhou | Published: 2026-07-29
AIシステムの関係性
リスク管理
倫理的ガイドライン遵守

SecRespond: Benchmarking AI Agents for Real-World Post-Compromise Incident Response

Authors: Lehan Wang, Boli Chen, Ruixue Ding, Pengjun Xie, Jinwei Huang, Zhendong Liu, Shuo Wang, Tao Lei, Xin Ouyang, Xiaomeng Li | Published: 2026-07-29
リスク評価
脆弱性管理
透かし

Physically Real-time Infrared Attack against Optical Flow Estimation Networks

Authors: Shen You, Wei Jiang, Jiarui Liu, Yijian Ye, Qiuzhen Lin, Xiangtao Li, Ka-Chun Wong | Published: 2026-07-29
敵対的攻撃評価
物理的敵対攻撃
透かし

FakeIDet3-DB: Refining Digital Attacks and Patch Extraction for Secure ID Benchmarking

Authors: Muñoz-Haro Javier, Teruel Andres, Tolosana Ruben, DeAlcala Daniel, Vera-Rodriguez Ruben, Morales Aythami, Fierrez Julian | Published: 2026-07-29
データセット評価
ディープフェイクの検知
透かし評価

Borrowed Strength: Best-of-N Search over a Code EncodingBreaks Self-Check Jailbreak Defenses

Authors: Haoyu Zhang, Shibo Zheng, Xiangchen Guan, Zhuoxi Wang, Zijian Xiao, Mohammad Zandsalimy, Shanu Sushmita | Published: 2026-07-29
大規模言語モデル
攻撃効果の評価
透かし評価

Guarding Organizations Against Malware Risk: A Novel Graph-Based Malware Detection Method

Authors: Yinan Gao, Jiarong Xu, Xiaohang Zhao, Xiao Fang | Published: 2026-07-29
プログラムグラフ解析
マルウェア分類
モデルアーキテクチャ

Recover, Decode, Reguard: Guard-Agnostic Defense Amplification againstEncoded VLM Jailbreaks

Authors: Haoyu Zhang, Zhuoxi Wang, Shibo Zheng, Zijian Xiao, Xiangchen Guan, Mohammad Zandsalimy, Shanu Sushmita | Published: 2026-07-29
プロンプトインジェクション
大規模言語モデル
透かし評価

FAS-R1: A Unified Multi-Task MLLM for Reasoning Face Anti-Spoofing

Authors: Hongyang Wang, Yichen Shi, Hongrui Li, Yiru Huo, Jun Feng, Zitong Yu | Published: 2026-07-29
AIシステムの関係性
モデル性能評価
倫理的考慮