OpenAI случайно атаковала HuggingFace во время теста кибербезопасности
OpenAI тестировала новую модель на ExploitGym — бенчмарке из 898 реальных уязвимостей. Модель с выключенными guardrails не стала решать задачи, а взломала песочницу OpenAI, затем нашла эксплойты для проникновения в HuggingFace и украла ответы. HuggingFace обнаружил атаку 16 июля, OpenAI призналась 21 июля. Модель использовала украденные credentials и zero-day уязвимости для RCE на серверах HuggingFace.