AIセキュリティポータルbot

Show Me How You Reason and I’ll Tell You Who You Are: Reasoning Graphs for Robust LLM Authorship Attribution

Authors: Zlata Kikteva, Artur Romazanov, Annette Hautli-Janisz, Ramon Ruiz-Dolz | Published: 2026-07-16
AIによる出力の識別
データセット分析
著者貢献

Innocuous-Seeming Data, Latent Ideology: Ideological Generalisation in Finetuned LLMs

Authors: Robert Graham, Edward Stevinson, Yariv Barsheshat | Published: 2026-07-16
インダイレクトプロンプトインジェクション
倫理的考慮
社会的影響

Is External Database Protection Static in Retrieval-Augmented Generation? Rethinking Privacy Preservation under Dynamic Queries

Authors: Gang Zhang, Mingyu Tian, Xukun Luan, Yuanchi Ma, Jinyan Liu | Published: 2026-07-16
RAG
トレードオフ分析
プライバシー保護手法

Large Audio Language Models for Spoofing-Aware Speaker Verification

Authors: Sofya Savelyeva, Mariia Perunova, Evgeny Kushnir, Artem Dvirniak, Dmitrii Korzh, Oleg Y. Rogov | Published: 2026-07-16
AIによる出力のバイアスの検出
SASV手法
評価メトリクス

MemPoison: Uncovering Persistent Memory Threats and Structural Blind Spots in LLM Agents

Authors: Jifeng Gao, Kang Xia, Yi Zhang, Xiaobin Hong, Mingkai Lin, Xingshen Wei, Wenzhong Li, Sanglu Lu | Published: 2026-07-16
インダイレクトプロンプトインジェクション
メモリ腐敗の分類
評価基準

Routing Ceilings Are Domain-Independent: Structural Prior Injection in Code Security Vulnerability Detection

Authors: Manuel Israel Cázares | Published: 2026-07-16
データセットの影響
脆弱性予測
評価基準

SportD: Can VLMs Physically Strategize?

Authors: Jasin Cekinmez, Addison J. Wu, Haotian Xia, Akshaya Bharadhwaj, Anay Putty, Anirudh Ravishankar, Jaewoong Lee, Jinglin Xiao, Kyumin Andrew Shim, Mishika Ahuja, Nisarga Patil, Leo Liu, Zhuohan Liu, Weining Shen | Published: 2026-07-16
モデル評価手法
行動分析手法
評価基準

Bad Memory: Evaluating Prompt Injection Risks from Memory in Agentic Systems

Authors: Soham Gadgil, David Alexander, Sai Sunku, Franziska Roesner | Published: 2026-07-16
インダイレクトプロンプトインジェクション
エージェント操作手法
脅威モデル

Auditing Fairness-Privacy Trade-offs: Subpopulation-Level Effects of Fairness-Enhancing Algorithms

Authors: Umid Suleymanov, Ilhama Novruzova, Khalid Mammadov, Natavan Hasanova, Murat Kantarcioglu | Published: 2026-07-16
公平性の確保
学習データの偏り
差分プライバシー

Democratizing Agent Deployment Safety: A Structural Monitoring Approach

Authors: Preeti Ravindra, Rahul Tiwari, Vincent Wolowski | Published: 2026-07-16
ITセキュリティの課題
脅威モデル
評価基準