
Защиту популярных ИИ-агентов научились ломать простейшим внушением. Эксперты из LayerX разработали атаку BioShocking. Нейросеть заманивают на сайт и вовлекают в текстовую игру, где базовые правила математики перевернуты — например, убеждают, что дважды два не равно четырем.
После этого встроенная безопасность ИИ полностью отказывает. В этот момент хакеры просят систему найти «скрытый код», под видом которого скрываются реальные пароли, куки и токены пользователя из браузера. Нейросети послушно воруют данные и отправляют их злоумышленникам.
Атака успешно сработала на сервисах OpenAI, Anthropic и Perplexity. Оперативно закрыть брешь смогла только OpenAI.











