文献データベース

Position Matters: Feature Inversion Attacks in ViT Split Inference with Token Reduction and Shuffling

Authors: Stefano Leggio, Giulio Rossolini, Alessandro Biondi | Published: 2026-09-01
データ再構築攻撃
評価結果
防御手法

Who Judges the Judges? A Chinese Safety QA Benchmark for Evaluating LLM Responses and Safety Judges

Authors: Rui Yang, Shuang Huang, Junhua Liu, Ziqi Zhao, Qingzhong Yan, Yuhang Sun, Cong Liu, Guoping Hu, Rui Mei, Jing Shao | Published: 2026-09-01
アライメント
プロンプトインジェクション
評価手法

Reveree: Diagnosing LLM Reverse-Engineering Agents

Authors: Hadjer Benkraouda, Hongyu Cai, Berkay Celik, Gang Wang | Published: 2026-09-01
エラー解析
ユーザ行動分析
知識分析

A SoK for SoCs: Reading the TI Leaves on AI for Cyber Threat Intelligence Generation and Sharing

Authors: Saastha Vasan, Hadjer Benkraouda, Jizhou Chen, Leyan Pan, Doguhan Yeke, Shinan Liu, Noah Spahn, Stefano Ortolani, David Evans, Christopher Kruegel, Giovanni Vigna | Published: 2026-09-01
サイバーセキュリティ
データプライバシー管理
モデルDoS

Jailbreaking Text-to-Image Models Through Cracks: Navigating Heterogeneous Safety Filters via Multi-Agent Debate

Authors: Kaiyan Wen, Shijie Zhang, Lu Yu, Guangdong Bai | Published: 2026-09-01
プロンプトインジェクション
攻撃者のアプローチ
防御手法

Using LLMs to Elicit Security Requirements for Service-Oriented Cyber Ranges

Authors: Michail Takaronis, Athanasia Kollarou, Georgios Kavallieratos, Vasileios Gkioulos, Sokratis Katsikas | Published: 2026-09-01
サイバーセキュリティ
システム要件
セキュリティ戦略生成

RISA: Response Inspection and Selective Actions for Refusal Calibration in Large Language Models

Authors: Wenhan Chang, Tianqing Zhu, Ping Xiong, Shiyi Liao, Wanlei Zhou | Published: 2026-09-01
エラー解析
モデルの頑健性保証
防御手法の効果分析

Triple-Bottom-Line Sustainability of Language Models for Edge AI: A Comparison Between SLMs and Quantized LLMs

Authors: Jainil Dharmil Shah | Published: 2026-09-01
プロンプトインジェクション
モデルの設計や精度
評価結果

NeuroGraph: An AI Graph-Driven Neuro-Symbolic Framework for Explainable Threat Reasoning in Advanced Manufacturing

Authors: Padmeswari Nandiya, Ahmad Mohsin, Ahmed Ibrahim, Iqbal H. Sarker, Helge Janicke | Published: 2026-09-01
RAGへのポイズニング攻撃
クエリ生成手法
グラフを用いたサイバーセキュリティの脅威分析

SoK: When Safe Agents Fail Together: The Security of Multi Agent LLM Systems

Authors: Rui Yang, Junjie Xu, Zhengyu Liu, Neil Fendley, Yang Hong, Ziyang Li, Yinzhi Cao | Published: 2026-09-01
マルチエージェントシステムのセキュリティ
攻撃パターン抽出
防御手法の効果分析