Securing Agentic AI: From Per-Action Checks to Trajectory Assurance Authors: Alireza Lotfi, Subangkar Karmaker Shanto, Imtiaz Karim, Elisa Bertino | Published: 2026-08-03 AIシステムの関係性リスク管理行動保証 2026.08.03 文献データベース
Cybersecurity Detection Classification with Reasoning-enabled Language Models Authors: Amol Khanna, Manu Nandan, Cristian Viorel Popa, Joan Pujol-Roig, Diana Bolocan, Laura Vasilie, Alexandru Apostu, Chase Helwig, Mihaela Gaman, Michael Brautbar, Edward Raff, Chase Midler, Sven Krasser | Published: 2026-07-30 プロンプトインジェクションモデル評価信頼評価 2026.07.30 文献データベース
Teffic-Audio: Tell Fact from Fiction Authors: Wan Lin, Li Wang, Jindong Wang, Kunyu Feng, Zhizheng Wu | Published: 2026-07-30 データセット評価データ拡張技術性能評価手法 2026.07.30 文献データベース
Security of World-Model-Based Embodied AI: A Lifecycle of Threats, Defenses, and Evaluation Authors: Fazhong Liu, Zhuoyan Chen, Haozhen Tan, Yan Meng, Guoxing Chen, Haojin Zhu | Published: 2026-07-30 モデルの頑健性保証リスク管理敵対的攻撃手法 2026.07.30 文献データベース
Piggybacking on Perception: Stealthy Concurrent Audio Prompt Injections against Multimodal LLM Agents Authors: Mingxiao Liu, Yitong Li, Haoren Zhao, Yaoxiang Bian, Jianan Ma, Jian Zhang, Jialuo Chen, Xinhao Deng, Zhen Wang | Published: 2026-07-30 インダイレクトプロンプトインジェクション攻撃効果の評価音声認識システムのセキュリティ 2026.07.30 文献データベース
Agent Harness Distillation: Inference-Time Harness Extraction and Exploitation in Autonomous Multi-Agent Systems Authors: Yu Cui, Wuli Yang, Yirui Shi, Junhao Xia, Hui Jiang, Lei Gao, Chenfu Bao | Published: 2026-07-30 攻撃効果の評価評価手法透かし評価 2026.07.30 文献データベース
MIND: Lightweight and Effective Memory Injection Defense for LLM Agents via Intent-Aware Information Bottleneck Authors: Dongyi Liu, Haixing He, Xiaobao Wu, Jia Li | Published: 2026-07-30 プロンプトリーキングメモリ防御問題毒データの検知 2026.07.30 文献データベース
Temporal Poisoning: Clean-Label Backdoors via Event Redistribution in SNNs Authors: Roberto Riaño, Gorka Abad, Stjepan Picek, Aitor Urbieta | Published: 2026-07-30 バックドア攻撃攻撃モデルの訓練毒データの検知 2026.07.30 文献データベース
Generalization and Trade-off in Adversarial Training: An RKHS Perspective via Kernel Integral Operators Authors: Yiling Xie, Xiaoming Huo | Published: 2026-07-30 性能評価指標敵対的学習正則化 2026.07.30 文献データベース
Driving up Inference Energy on SNNs: Per-Sample and Universal Sponge Attacks Authors: Spyridon Raptis, Haralampos-G. Stratigopoulos | Published: 2026-07-30 トリガーの検知性能評価指標脆弱性研究 2026.07.30 文献データベース