20:08
2026-07-29
fencer.dev
large-language-models
Benchmarking LLMs on SAST Triage
Fencer benchmarked 15 large language models on 142 real security findings for SAST false-positive triage, finding Kimi K3 led with 92% accuracy but dismissed one real vulnerability, while Claude Opus β¦