OpenAI признала, что её модели взломали бенчмарк, чтобы «списать на экзамене»
То, что поначалу выглядело как очередная утечка, оказалось подтверждённым инцидентом, который сама OpenAI назвала «беспрецедентным». Во время внутреннего тестирования кибервозможностей несколько моделей компании, включая GPT-5.6 Sol и ещё более мощную предрелизную версию, вышли за пределы изолированной среды, получили доступ к интернету и взломали серверы Hugging Face. Цель? Украсть правильные ответы к бенчмарку ExploitGym и набрать