AIセキュリティポータルbot

Deep Noir: Autonomous Steering Discovery via Architectural Chronometry in Transformer Models

Authors: Frank E. Bobe, Gregory D. Vetaw, Darshan W. Bryner, Matthew G. Cook, Jose L. Salas-Vernis | Published: 2026-09-17
研究方法論
評価プロトコル
評価メトリクス

Inference-Engine Fingerprinting Attacks are Practical: Exploring Model-Driven Environmental Discovery, Exploitation, and Escape

Authors: Sarah Radway, Andrew Cheng, Vijay Janapa Reddi, James Mickens | Published: 2026-09-17
システムプロンプト生成
セキュリティ分析
ソフトウェアセキュリティ

Towards TEE-Certified DP: Verifiable Differentially Private Training on Legacy GPUs

Authors: Li Ge, Wenjie Qu, Weitao Feng, Yi Zeng, Jiaheng Zhang, Xiaofeng Wang, Wei Dong | Published: 2026-09-17
TEEsのセキュリティ
トリガーの検知
差分プライバシー

Fingerprinting Multimodal Large Language Models

Authors: Chao Huang, Meng Tong, Kejiang Chen | Published: 2026-09-17
フィンガープリンティング手法
プロンプトリーキング
知識蒸留

Local Sparsity Enables Unsupervised LLM Safety Detection

Authors: Xin Chen, Gil Kur, Alexander Shevchenko, Andreas Krause | Published: 2026-09-17
データ駆動型クラスタリング
検出手法の分析
異常検知アルゴリズム

A Proposal for an Agentic AI Architecture to Support Multi-Domain Decision-Making in the Brazilian Armed Forces

Authors: Gioliano de Oliveira Braga, Sidnei Barbieri, Ágney Lopes Roth Ferraz, Wagner Comin Sonaglio, Henrique Curi de Miranda e Lourenço Alves Pereira | Published: 2026-09-17
インダイレクトプロンプトインジェクション
人間の関与
運用シナリオ

CoRELoop: Parameter-Efficient Controlled Recurrent Refinement for Audio Deepfake Detection

Authors: Kunyu Feng, Yuxiang Wang, Li Wang, Wan Lin, Zhizheng Wu | Published: 2026-09-17
ディープフェイクの検知
検出手法の分析
異常検知アルゴリズム

Contagion on the Trading Floor: How Adversarial Signals Spread in Multi-Agent Trading Systems

Authors: Qi Rong Sua, Junhao Dong, Nguyen Duc Thai, Yuqing Wen, Cheston Tan, Yew-Soon Ong | Published: 2026-09-17
対抗的エージェント
攻撃効果の評価
攻撃者のアプローチ

ALIBI: Adversarial Legitimacy Injection in Binary Input against LLM Malware Analyzers

Authors: Hyeongjun Choi, Wonyoung Jung, Haehoon Seo, Sungyup Nam | Published: 2026-09-17
インダイレクトプロンプトインジェクション
マルウェアファミリー
攻撃の評価

SoK: Trading Agents or Market Crashers? Dissecting Robustness and Security Failures in Academic Financial LLM Trading Schemes

Authors: Mengxiao Wang, Nitesh Saxena | Published: 2026-09-17
AIによる出力の識別
インダイレクトプロンプトインジェクション
金融セキュリティ分析