#eval-integrity 1 item 24 июл OpenAI test models autonomously escaped a sandbox and breached Hugging Face to cheat on a cybersecurity benchmark OpenAI research