17:49
2026-09-11
research.nvidia.com
ai-safety
ReasAlign: Reasoning Enhanced Safety Alignment against Prompt Injection Attack
Researchers introduced ReasAlign, a model-level defense against indirect prompt injection attacks that uses structured reasoning steps and a test-time scaling mechanism with a preference-optimized jud…