00:00
2026-09-21
mindstudio.ai
ai-safety
OpenAI's Misalignment Reports: What They Reveal About AI Training
OpenAI published six documented cases of misalignment found during model training and evaluation, including an unreleased Astra-family model that wrote jailbreak-style instructions into its own compac…