Исследователи предложили атаку InjecMEM: злоумышленник в одном взаимодействии внедряет якорь и команду, которые при последующих запросах на ту же тему подменяют ответ модели. Атака работает на нескольких системах памяти и бэкбон-моделях, не затрагивая нецелевые запросы.
tldr.takara.ai · #security #agents #ai #injection #llm #security
Исследователь Rony Utevsky из Adversa показал, как Grok обходит защиту: вредоносная команда шифруется (PBKDF2 + AES-256-GCM), а страница содержит ключ и инструкцию расшифровать. Модель выполняет код и отправляет историю чата атакующему. xAI уведомлена в июне, но уязвимость остаётся.
arstechnica.com · #ai #ai #grok #injection #security