Privacy-Preserving and Verifiable Approximate Distributed Coded Computing Authors: Xavier Martínez-Luaña, Alba Gude-Santos, Manuel Fernández-Veiga, Rebeca P. Díaz-Redondo | Published: 2026-07-02 Byzantine Attack CountermeasuresDifferential Privacy脆弱性評価 2026.07.02 2026.07.04 Literature Database
A rubric-based controlled comparison of frontier language models on expert-authored clinical reasoning tasks Authors: Samiha A. Ismail, Fan X. Chen, Ali Merali | Published: 2026-07-02 Model EvaluationReview and Investigation医療診断属性 2026.07.02 2026.07.04 Literature Database
Behind the Refusal: Determining Guardrail Activation via Behavioral Monitoring Authors: William Hackett, Peter Garraghan | Published: 2026-07-02 Statistical Testing脆弱性評価Vulnerability Assessment Method 2026.07.02 2026.07.04 Literature Database
ContextNest: Verifiable Context Governance for Autonomous AI Agent Authors: Misha Sulpovar, Benn R. Konsynski, Qaish Kanchwala, Gabe Goodhart | Published: 2026-07-02 RAGドキュメント構造監査トレース 2026.07.02 2026.07.04 Literature Database
kNNGuard: Turning LLM Hidden Activations into a Training-Free Configurable Guardrail Authors: Mahmoud Abdelfattah, Hamid Nasiri, Peter Garraghan | Published: 2026-07-02 AlignmentPrompt Injection脆弱性評価 2026.07.02 2026.07.04 Literature Database
ElephantAgent: Contextual State Continuity in Agentic Systems Authors: Jiankai Jin, Xiangzheng Zhang, Zhao Liu, Wenzhuo Xu, Dongdong Yang, Deyue Zhang, Quanchen Zou | Published: 2026-07-02 Indirect Prompt Injectionエージェント操作手法Vulnerability Management 2026.07.02 2026.07.04 Literature Database
Safety Targeted Embedding Exploit via Refinement Authors: Joshua Adrian Cahyono | Published: 2026-07-02 Prompt InjectionPrompt leakingVulnerability Management 2026.07.02 2026.07.04 Literature Database
Safety Testing LLM Agents at Scale: From Risk Discovery to Evidence-Grounded Verification Authors: Yunhao Feng, Ruixiao Lin, Ming Wen, Qinqin He, Yanming Guo, Yifan Ding, Yutao Wu, Jialuo Chen, Yunhao Chen, Xiaohu Du, Jianan Ma, Zixing Chen, Zhuoer Xu, Xingjun Ma, Xinhao Deng | Published: 2026-07-02 エージェント操作手法Threat ModelVulnerability Management 2026.07.02 2026.07.04 Literature Database
DRL-CLBA: A Clean Label Backdoor Attack for Speech Classification via DDPG Reinforcement Learning Authors: Yueming Huang, Wenhan Yao, Fen Xiao, Xiarun Chen, Weiping Wen | Published: 2026-07-02 Backdoor AttackDetection of Poison Data for Backdoor AttacksModel Performance Evaluation 2026.07.02 2026.07.04 Literature Database
Pmeta-TLA: Backdoor Attacks for Speech Classification Models via Meta-Learning with Timbre Leakage Attack Authors: Yueming Huang, Wenhan Yao, Fen Xiao, Xiarun Chen, Weiping Wen | Published: 2026-07-02 Backdoor AttackDetection of Poison Data for Backdoor Attacksメタ学習 2026.07.02 2026.07.04 Literature Database