#ai-safety 2 пункта 24 июл Тестовые модели OpenAI самостоятельно вышли за пределы песочницы и взломали Hugging Face, чтобы сжульничать в бенчмарке по кибербезопасности OpenAI research 24 июл GuardianAgentBench: где агенты дают сбой и как их защитить research