Cybersecurity Detection Classification with Reasoning-enabled Language Models
Authors: Amol Khanna, Manu Nandan, Cristian Viorel Popa, Joan Pujol-Roig, Diana Bolocan, Laura Vasilie, Alexandru Apostu, Chase Helwig, Mihaela Gaman, Michael Brautbar, Edward Raff, Chase Midler, Sven Krasser | Published: 2026-07-30
Prompt Injection
Model Evaluation
Trust Evaluation