文献データベース

Small, Free, and Effective: Orchestrating Open-Weight Small Language Models to Outperform Single LLM for Malware Analysis

Authors: Adel ElZemity, Shujun Li, Budi Arief | Published: 2026-07-22
プロンプトインジェクション
マルウェア可視化
大規模言語モデル

HijackKV: New Threat in Position-Independent KV Cache Reuse

Authors: Yichi Zhang, Zhiqi Wang, Huan Zhang, Yuchen Yang | Published: 2026-07-22
RAGへのポイズニング攻撃
データセット評価
攻撃手法の効果

Defense Against LLM Backdoors using Critical Neuron Isolation Pruning

Authors: Yuxi Li, Zhibo Zhang, Kailong Wang, Xingshuo Han, Ling Shi, Haoyu Wang | Published: 2026-07-22
LLMの安全機構の解除
プロンプトリーキング
モデル保護手法

Know Your Agent: Reconnaissance-Driven Pentesting of AI Agents

Authors: Or Zion Eliav, Eyal Lenga, Shir Bernstien, Yisroel Mirsky | Published: 2026-07-22
インダイレクトプロンプトインジェクション
攻撃手法の効果
脆弱性評価手法

An Automated Framework for Extracting Reachable Attack Chains from Cyber Threat Intelligence Reports

Authors: Wenbo Hou, Ning Hu, Xueping Wang, Jiahao Gu, Wenjian Luo | Published: 2026-07-22
攻撃手法の効果
脆弱性評価手法
評価指標

Data-Poisoning Audits for Causal Effect Estimation

Authors: Kwangho Kim | Published: 2026-07-22
データセットの問題
データセット評価
統計的分析

FedLSG: LLM-Enhanced Semantic Calibration for Federated Graph Backdoor Defense

Authors: Chenyu Zhou, Yabin Peng, Wei Huang, Kunlin Li, Shuaishuai Zhang, Xinyuan Miao | Published: 2026-07-22
RAGへのポイズニング攻撃
モデル保護手法
攻撃手法の効果

The safety failures we are not instrumenting: a perspective on hidden safety-critical challenges in modern AI systems

Authors: Gjergji Kasneci, Enkelejda Kasneci | Published: 2026-07-21
AIシステムの関係性
プロンプトリーキング
リスク評価

They’ll Verify. They Just Won’t Act. How Authority Framing and Laundered Code Turn a Trusted Agentic CI/CD Pipeline Into an Attack Surface

Authors: Yohann Sidot | Published: 2026-07-21
インダイレクトプロンプトインジェクション
攻撃手法の効果
透かし設計

MIRA-Ev:A Benchmark for Granular Evidence Detection and Relational Reasoning in Clinical Exams

Authors: Iker De la Iglesia, Johanna Ramirez-Romero, Jose Maria Villa-Gonzalez, Irune Urroz García, Ander Barrena, Aitziber Atutxa | Published: 2026-07-21
データセット評価
医療画像分析
臨床研究