TOUR: A Trajectory-Level Unlearning Benchmark for Offline Reinforcement Learning Authors: Chaofan Pan, Lingfei Ren, Xiangyu Jiang, Yanhua Li, Xuemei Cao, Xiangkun Wang, Hao Yu, Wei Wei, Xin Yang | Published: 2026-07-23 データセット評価攻撃手法の効果文献レビュー 2026.07.23 文献データベース
GuardianAgentBench: Where Agents Fail and How to Guard Them Authors: Vishal Ishwar Naik, Chenyu Xu, Donna Dong, Hussein Hassan, Abhishek Pradhan, Ofer Mendelevitch, Tallat Shafat, Humayun Irshad | Published: 2026-07-23 インダイレクトプロンプトインジェクションタスク設計プロンプトインジェクション 2026.07.23 文献データベース
Is Deep Research Reliable? Misleading Knowledge Induces False Conclusions Authors: Pengyu Zhu, Lijun Li, Longju Yang, Sen Su | Published: 2026-07-23 タスク設計データセットの問題偽情報の検出 2026.07.23 文献データベース
Beyond Heavy Log Curation: Perplexity-Based APT Detection via Unsupervised, Context-Augmented Language Models Authors: Shoya Otsu, Kei Suzuki, Toshiaki Koike-Akino, Jing Liu, Ye Wang | Published: 2026-07-23 データセット評価モデル通信機械学習 2026.07.23 文献データベース
Generative AI floods and dilutes the market for books Authors: Tuhin Chakrabarty, Xinyue Liu, Jane C. Ginsburg, Paramveer Dhillon | Published: 2026-07-22 データセットの問題ユーザー行動分析統計的分析 2026.07.22 文献データベース
The Ethics of Autonomous AI Agents for Offensive Security Authors: Andreas Happe, Jürgen Cito, Jasmin Wachter | Published: 2026-07-22 インダイレクトプロンプトインジェクション倫理基準遵守責任帰属システム設計 2026.07.22 文献データベース
Small, Free, and Effective: Orchestrating Open-Weight Small Language Models to Outperform Single LLM for Malware Analysis Authors: Adel ElZemity, Shujun Li, Budi Arief | Published: 2026-07-22 プロンプトインジェクションマルウェア可視化大規模言語モデル 2026.07.22 文献データベース
HijackKV: New Threat in Position-Independent KV Cache Reuse Authors: Yichi Zhang, Zhiqi Wang, Huan Zhang, Yuchen Yang | Published: 2026-07-22 RAGへのポイズニング攻撃データセット評価攻撃手法の効果 2026.07.22 文献データベース
Defense Against LLM Backdoors using Critical Neuron Isolation Pruning Authors: Yuxi Li, Zhibo Zhang, Kailong Wang, Xingshuo Han, Ling Shi, Haoyu Wang | Published: 2026-07-22 LLMの安全機構の解除プロンプトリーキングモデル保護手法 2026.07.22 文献データベース
Know Your Agent: Reconnaissance-Driven Pentesting of AI Agents Authors: Or Zion Eliav, Eyal Lenga, Shir Bernstien, Yisroel Mirsky | Published: 2026-07-22 インダイレクトプロンプトインジェクション攻撃手法の効果脆弱性評価手法 2026.07.22 文献データベース