OpenAI published a framework for tracking, investigating, and disclosing instances of model misalignment, including six documented cases of unexpected model behavior.

OpenAI shares a framework for tracking, investigating, and disclosing model misalignment, alongside six reports of unexpected or concerning model behavior.