文献データベース

Beyond F1: Evaluating Coverage and Failure Recovery in AI Model Security Scanners

Authors: Qianlong Lan, Vinothini Pandurangan, Anuj Kaul, Indranil Sanyal | Published: 2026-08-27
セキュリティ検証手法
マルウェア検出シナリオ
モデル評価

SPA: Securing Persistent LLM Agents Across Queries with Plan-First Information-Flow Control

Authors: Dylan Girrens, Guangjing Wang | Published: 2026-08-27
インダイレクトプロンプトインジェクション
プラン設計

Safety Does Not Compose: Non-Decaying Loop State for Autonomous LLM Agents

Authors: Chenhao Wu, Haoxuan Jia, Yang Liu, Yingguang Yang, Yuhan Lin, Chongyang Zhang, Hao Zheng, Yulin Huang, Jianshen Zhang, Yongzhi Qi, Shang Luo, Kefu Xu, Jifeng Zhu, Bin Chong | Published: 2026-08-27
セキュリティ検証手法
リスク管理手法
攻撃成功率

LAAF: A Layered Accountability Architecture Framework for LLM Applications

Authors: Prachi Chaturvedi, Shahnawaz Ahmad, Ehsan Nowroozi, Muhammad Waqas, George Loukas, Alireza Jolfaei, Lucas Cordeiro, Pierre Dantas | Published: 2026-08-27
RAG
法的責任
責任帰属システム設計

PLCBench: Can Autonomous LLM Agents Turn PLC Access into Sustained Physical Impact?

Authors: Yitian Zhou, Jingyu Zheng, Qiliang Jiang, Linkang Du, Haoming Liu, Lichao Wu, Shiyi Zhao, Mengxiang Liu, Ruilong Deng | Published: 2026-08-27
システム開発
モデル評価手法

Are We Shooting Flies with Cannons? Trade-off Analysis for AI-based 5G Intrusion Detection

Authors: Federica Uccello, Simin Nadjm-Tehrani | Published: 2026-08-27
データセットの影響
プロンプトインジェクション
モデル評価手法

When Relationships Break: Interpreting Network Traffic Anomalies via Dependency Violations

Authors: Federica Uccello, Simin Nadjm-Tehrani | Published: 2026-08-27
依存関係管理
統計的検証手法
解釈可能性

Daydreaming: Stealing Hidden Agent Skills through Black-Box Task Interaction

Authors: Yu-Lin Tsai, Yu-An Lu, Ci-Yang Tsai, Muxi Lyu, Raluca Ada Popa, Chia-Mu Yu | Published: 2026-08-27
攻撃効果の評価
攻撃計画手法
知識抽出手法

Beyond Vector Hiding: Breaking and Mitigating Shared-Direction Weight Obfuscation in TEE-Offloaded Large Language Models

Authors: Menghui Zhang, Aoying Zheng, Guoxiao Liu, Zizhuang Deng, Jiejing Wen, Jincheng Zhuang, Ran Tao | Published: 2026-08-27
TEEsのセキュリティ
プロンプトリーキング
信号処理技術

Unsaid, Unsafe? Implicit Security Obligations in LLM-Based RTL Code Generation

Authors: Guang Yang, Xing Hu, Xiang Chen, Xin Xia | Published: 2026-08-27
セキュリティ検証手法
プロンプトリーキング
設計検証