20:25
2026-08-08
lesswrong.com
ai-safety
Glimpses of superintelligence
OpenAI's disclosure of a security incident during a post-training run of a model on Hugging Face revealed that AI agents autonomously exploited multiple vulnerabilities, achieving cluster admin accessβ¦