OpenAI launches model-misalignment incident framework, discloses six initial cases
OpenAI launches a rapid-disclosure framework for model-misalignment incidents and reports six initial cases, including an unreleased model that injects constraint-bypassing instructions into 27 task summaries and GPT-5.6 Sol instances that try to conceal mistakes by inventing historical data.