MMJailBench: A Factorized Benchmark for Disentangling Multimodal Jailbreak Vulnerabilities Authors: Tianshi Wang, Jingsong Wang, Yafei Huang, Fengling Li, Xin Li, Lei Zhu | Published: 2026-08-26 Large Language ModelVulnerability Assessment Method視覚的セマンティクス 2026.08.26 2026.08.28 Literature Database
MACGen: Toward Functionally Correct and Secure Code Generation via Multi-Agent Collaboration Authors: Miseon Yu, Jaehoon Choi, Younghan Lee, Yunheung Paek | Published: 2026-08-26 System Developmentセキュリティ考慮Prompt Injection 2026.08.26 2026.08.28 Literature Database
Distance Is Not Enough: Forget-Retain Alignment Gap Predicts LLM Relearning Robustness Authors: Yi Chen, Hanna Hsieh, Shuhong Liu, Chuanbo Hua, Zihan Ma, Kun Wang, Joo-Young Kim | Published: 2026-08-26 Model RobustnessRobustness of Deep NetworksKnowledge Distillation 2026.08.26 2026.08.28 Literature Database
Refusal geometry reflects refusal training: diverse refusal prefixes can raise stable rank and weaken refusal vector ablation attacks Authors: Andrey Labunets | Published: 2026-08-26 PoisoningModel Robustness攻撃戦略分析 2026.08.26 2026.08.28 Literature Database
FinRiskAtlas: Decision-Aligned Evaluation of Large Language Models for Financial Risk Review Authors: Suyang Zhong, Jingzhe Zhu, Qi Xu, Liyao Sun, Yin Wang, Qingqing Sun, Shuai Chen, Tianyi Zhang | Published: 2026-08-26 Dataset ApplicabilityMachine Learning ApplicationState Transition Model 2026.08.26 2026.08.28 Literature Database
LLMscope: Extracting LLM Assets from Edge AI Chips via Optical Probing Authors: Dev Mehta, Lily Dukette, William Folan, Olivia Kochol, Noah Solomon, Shahin Tajik, Fatemeh Ganji | Published: 2026-08-26 Indirect Prompt InjectionTestbed資産識別 2026.08.26 2026.08.28 Literature Database
Combining Self-Embedding Audio Watermarking with Ultra-Low-Bitrate Neural Codecs Authors: Yigitcan Özer, Xin Wang, Zhe Zhang, Junichi Yamagishi | Published: 2026-08-26 Signal AnalysisSelf-Evolving FrameworkDefense Mechanism 2026.08.26 2026.08.28 Literature Database
A Training-Free Proactive Defense Against Partial Speech Manipulation via Self-Embedding Steganography Authors: Yigitcan Özer, Zhe Zhang, Wanying Ge, Xin Wang, Junichi Yamagishi | Published: 2026-08-26 Signal AnalysisDefense Mechanism音声透かし技術 2026.08.26 2026.08.28 Literature Database
Prompt Structure Redistributes, Not Reduces: An Empirical Analysis of Security-Weaknesses in LLM-Generated Python Code Authors: Maitreyee Das Urmi, Jessica Pourleyli, Fabio Santos, Glaucia Melo | Published: 2026-08-25 セキュリティ考慮Prompt InjectionPrompt leaking 2026.08.25 2026.08.27 Literature Database
Right Diagnoses, Decorative Reasoning:A Perturbation Audit of Medical Chain-of-Thought Authors: Mengzhu Xu, Jifan Gao, Xia Jiang, Yaoxin Wu, Xi Long | Published: 2026-08-25 Reliability ScoringWatermarking Settings for Medical DataResearch Methodology 2026.08.25 2026.08.27 Literature Database