Literature Database

BenchShield: Formal Model-Backed Instrumentation for Reward Integrity in LLM-Agent Evaluation Infrastructure

Authors: Shenghan Zheng, Zonglin Di, Yimin Liu, Kyoung Whan Choe, Jiankai Sun, Heguang Lin, Penghao Jiang, Yifeng He, Xiao Cheng, Jicheng Wang, Wenbo Chen, Alex Yates, Yinzhe Zhao, Bingran You, Yuan Gao, Ayush Munot, Shubham Gaur, Zhe Ye, Hao Wang, Xiangyi Li, Dawn Song, Christophe Hauser | Published: 2026-09-10
構造的結果
監査トレース
Evaluation Method

DeFiFusion: Combining Transaction Events with Smart Contracts to Detect Price Manipulation Attacks

Authors: Rui Cao, Shaojing Fan, Liming Fang, Yuchan Liu, Yingying Jiao, Zhenguang Liu | Published: 2026-09-10
Event Trace Analysis
Analysis of Detection Methods
Evaluation Method

Demystifying the Privacy-Utility Trade-off in LLM Interactions

Authors: Zhenhua Liu, Zhanxu Xie, Junjie Yu, Tong Zhu, Lijun Li, Wenliang Chen | Published: 2026-09-10
プライバシーとユーティリティのトレードオフ
User Characteristics
Differential Privacy

Towards Tackling Application Logic Flaws through Autonomous Formal-Logic Modeling and Automated Reasoning

Authors: Yiwei Fang, Yichen Liu, Ze Jin, Haoqiang Wang, Qixu Liu, Luyi Xing | Published: 2026-09-09
IoT Cybersecurity
User Authentication System
攻撃手法の効果

Towards Scalable and Cost-Efficient Vulnerability Detection: A Study on Automatic Query Generation

Authors: Ivana Clairine Irsan, Ratnadira Widyasari, Huihui Huang, Ting Zhang, Yue Liu, Ouh Eng Lieh, Shar Lwin Khin, Kang Hong Jin, David Lo | Published: 2026-09-09
Cybersecurity
Prompt Injection
Vulnerability Prediction

Learning Intrusion Response Strategies for OT Systems

Authors: Duc Huy Le, Rolf Stadler | Published: 2026-09-09
POMDP Problem
攻撃シナリオ
防御戦略

Maverick: Private and Verifiable LLM Inference Made Practical via Matrix-Vector Multiplication Delegation

Authors: Ben Merbaum, Mohammad Amin Raeisi, Wenhao Wang, Charalampos Papamanthou, Katerina Sotiraki, Fan Zhang | Published: 2026-09-09
Efficient Configuration Verification
評価結果
透かし手法

Active Adaptation, Not Static Defense: Temporal Dynamics of Preventative Steering in Adversarial Fine-Tuning

Authors: Jing Guan, Yachao Yang, Zhaoliang Liu, Yuyao Zhang, Fanyu Meng, Junlan Feng | Published: 2026-09-09
Prompt Injection
Model Robustness
Adaptive Adversarial Training

Understanding the Security Boundary of Obfuscation-based On-Device LLM Protection

Authors: Hanyi Zhou, Chenyang Li, Yuanzhe Pang, Ke Xu, Mingwei Xu, Zhuotao Liu | Published: 2026-09-09
TEEsのセキュリティ
Backdoor Detection
透かし手法

Belief-State Engine: Augmenting LLMs for Principled Planning Under Partial Observability

Authors: Arnab Chattopadhayay, Debdipta Halder | Published: 2026-09-09
POMDP Problem
ポリシー生成
実験手法