Prompt injection

Защиту Grok обошли с помощью зашифрованных инструкций: под угрозой история чатов

Защиту Grok обошли с помощью зашифрованных инструкций: под угрозой история чатов

Исследователь Adversa обнаружил способ обойти защитные фильтры xAI: Grok расшифровывает вредоносную команду внутри собственного кода и отправляет имя, местоположение и историю чатов пользователя на сервер атакующего

ИИ-агентов научили помнить — теперь их память можно взломать

ИИ-агентов научили помнить — теперь их память можно взломать

Исследователи представили GhostWriter: атака позволяет внедрять ложные воспоминания в агентов через письма и календари с эффективностью до 98%