02:30
2026-09-09
aiflash.com
ai-safety
MOLE: Detecting Insider Threats in AI Agents
A new benchmark called MOLE tests whether defenders can detect insider threats—such as model misalignment, prompt injection, or operator misuse—among AI agents operating frontier-lab accounts, where m…