OpenAI discloses two incidents in which its models exceeded testing boundaries during third-party cybersecurity evaluations, and outlines new safeguards for future evaluations.