AIセキュリティポータルbot

Show Me How You Reason and I’ll Tell You Who You Are: Reasoning Graphs for Robust LLM Authorship Attribution

Authors: Zlata Kikteva, Artur Romazanov, Annette Hautli-Janisz, Ramon Ruiz-Dolz | Published: 2026-07-16
Identification of AI Output
Dataset Analysis
Author Contribution

Innocuous-Seeming Data, Latent Ideology: Ideological Generalisation in Finetuned LLMs

Authors: Robert Graham, Edward Stevinson, Yariv Barsheshat | Published: 2026-07-16
Indirect Prompt Injection
Ethical Considerations
Social Impact

Is External Database Protection Static in Retrieval-Augmented Generation? Rethinking Privacy Preservation under Dynamic Queries

Authors: Gang Zhang, Mingyu Tian, Xukun Luan, Yuanchi Ma, Jinyan Liu | Published: 2026-07-16
RAG
Trade-off Analysis
Privacy Protection Method

Large Audio Language Models for Spoofing-Aware Speaker Verification

Authors: Sofya Savelyeva, Mariia Perunova, Evgeny Kushnir, Artem Dvirniak, Dmitrii Korzh, Oleg Y. Rogov | Published: 2026-07-16
Bias Detection in AI Output
SASV手法
評価メトリクス

MemPoison: Uncovering Persistent Memory Threats and Structural Blind Spots in LLM Agents

Authors: Jifeng Gao, Kang Xia, Yi Zhang, Xiaobin Hong, Mingkai Lin, Xingshen Wei, Wenzhong Li, Sanglu Lu | Published: 2026-07-16
Indirect Prompt Injection
メモリ腐敗の分類
評価基準

Routing Ceilings Are Domain-Independent: Structural Prior Injection in Code Security Vulnerability Detection

Authors: Manuel Israel Cázares | Published: 2026-07-16
データセットの影響
Vulnerability Prediction
評価基準

SportD: Can VLMs Physically Strategize?

Authors: Jasin Cekinmez, Addison J. Wu, Haotian Xia, Akshaya Bharadhwaj, Anay Putty, Anirudh Ravishankar, Jaewoong Lee, Jinglin Xiao, Kyumin Andrew Shim, Mishika Ahuja, Nisarga Patil, Leo Liu, Zhuohan Liu, Weining Shen | Published: 2026-07-16
Model evaluation methods
行動分析手法
評価基準

Bad Memory: Evaluating Prompt Injection Risks from Memory in Agentic Systems

Authors: Soham Gadgil, David Alexander, Sai Sunku, Franziska Roesner | Published: 2026-07-16
Indirect Prompt Injection
エージェント操作手法
Threat Model

Auditing Fairness-Privacy Trade-offs: Subpopulation-Level Effects of Fairness-Enhancing Algorithms

Authors: Umid Suleymanov, Ilhama Novruzova, Khalid Mammadov, Natavan Hasanova, Murat Kantarcioglu | Published: 2026-07-16
Ensuring Fairness
Bias in Training Data
Differential Privacy

Democratizing Agent Deployment Safety: A Structural Monitoring Approach

Authors: Preeti Ravindra, Rahul Tiwari, Vincent Wolowski | Published: 2026-07-16
Challenges in IT Security
Threat Model
評価基準