文献データベース

Securing Agentic AI: From Per-Action Checks to Trajectory Assurance

Authors: Alireza Lotfi, Subangkar Karmaker Shanto, Imtiaz Karim, Elisa Bertino | Published: 2026-08-03
AIシステムの関係性
リスク管理
行動保証

Cybersecurity Detection Classification with Reasoning-enabled Language Models

Authors: Amol Khanna, Manu Nandan, Cristian Viorel Popa, Joan Pujol-Roig, Diana Bolocan, Laura Vasilie, Alexandru Apostu, Chase Helwig, Mihaela Gaman, Michael Brautbar, Edward Raff, Chase Midler, Sven Krasser | Published: 2026-07-30
プロンプトインジェクション
モデル評価
信頼評価

Teffic-Audio: Tell Fact from Fiction

Authors: Wan Lin, Li Wang, Jindong Wang, Kunyu Feng, Zhizheng Wu | Published: 2026-07-30
データセット評価
データ拡張技術
性能評価手法

Security of World-Model-Based Embodied AI: A Lifecycle of Threats, Defenses, and Evaluation

Authors: Fazhong Liu, Zhuoyan Chen, Haozhen Tan, Yan Meng, Guoxing Chen, Haojin Zhu | Published: 2026-07-30
モデルの頑健性保証
リスク管理
敵対的攻撃手法

Piggybacking on Perception: Stealthy Concurrent Audio Prompt Injections against Multimodal LLM Agents

Authors: Mingxiao Liu, Yitong Li, Haoren Zhao, Yaoxiang Bian, Jianan Ma, Jian Zhang, Jialuo Chen, Xinhao Deng, Zhen Wang | Published: 2026-07-30
インダイレクトプロンプトインジェクション
攻撃効果の評価
音声認識システムのセキュリティ

Agent Harness Distillation: Inference-Time Harness Extraction and Exploitation in Autonomous Multi-Agent Systems

Authors: Yu Cui, Wuli Yang, Yirui Shi, Junhao Xia, Hui Jiang, Lei Gao, Chenfu Bao | Published: 2026-07-30
攻撃効果の評価
評価手法
透かし評価

MIND: Lightweight and Effective Memory Injection Defense for LLM Agents via Intent-Aware Information Bottleneck

Authors: Dongyi Liu, Haixing He, Xiaobao Wu, Jia Li | Published: 2026-07-30
プロンプトリーキング
メモリ防御問題
毒データの検知

Temporal Poisoning: Clean-Label Backdoors via Event Redistribution in SNNs

Authors: Roberto Riaño, Gorka Abad, Stjepan Picek, Aitor Urbieta | Published: 2026-07-30
バックドア攻撃
攻撃モデルの訓練
毒データの検知

Generalization and Trade-off in Adversarial Training: An RKHS Perspective via Kernel Integral Operators

Authors: Yiling Xie, Xiaoming Huo | Published: 2026-07-30
性能評価指標
敵対的学習
正則化

Driving up Inference Energy on SNNs: Per-Sample and Universal Sponge Attacks

Authors: Spyridon Raptis, Haralampos-G. Stratigopoulos | Published: 2026-07-30
トリガーの検知
性能評価指標
脆弱性研究