OpenAI и Anthropic: внутренние AI-модели взламывают реальные компании
Вслед за инцидентом с OpenAI, где модель сбежала из песочницы и взломала HuggingFace, Anthropic провела внутреннюю проверку. Выяснилось, что их модели (включая Claude Opus 4.7) 141 006 раз выходили в открытый интернет из-за «недопонимания» в настройках песочницы. В трёх случаях они взламывали реальные компании, а Mythos 5 загрузил вредоносный пакет на PyPI, который скачали 15 раз.