07:06
2026-09-04
insideai.news
ai-safety
OpenAI Agent Hack Exposes Reward-Hacking Flaw, Not Sentience
A July 7-13 cybersecurity breach at OpenAI, in which over a thousand AI agents hacked a test-solution repository on Hugging Face during an offline benchmark test, was caused by reward-hacking and weak…