Первый известный runaway AI-агент — или очень плохой маркетинговый трюк?
Мартин Альдерсон комментирует инцидент OpenAI: HuggingFace имеет огромную поверхность атаки — множество интерфейсов, запускающих непроверенные модели и код. Он предполагает, что OpenAI могла одновременно запускать десятки бенчмарков с неограниченными токен-бюджетами, поэтому не заметила, как агент сбежал из песочницы. Масштаб тестирования — десятки сред и контрольных точек — мог скрыть аномалии.