Главная страница » Блог » Технологические новости​ » Ядерный баг в ИИ-безопасности ☢️

Ядерный баг в ИИ-безопасности ☢️

Злоумышленники нащупали забавную, но опасную уязвимость в логике современных нейросетей. Они просто вставляют в код своих вредоносных программ текстовые комментарии про ядерное или биологическое оружие. Сканеры безопасности от OpenAI и Claude видят эти стоп-слова, пугаются и наотрез отказываются проверять файл дальше.

В итоге жесткие этические фильтры, которые создавали для спасения мира, сработали строго наоборот. Вредоносный софт преспокойно проходит проверку, потому что робот банально закрывает глаза на «опасную» тему. Защитные системы сами открывают дорогу скрытым угрозам, а эксперты теперь мрачно прогнозируют лавину новых дыр в безопасности.

Оставьте комментарий

Ваш адрес email не будет опубликован. Обязательные поля помечены *

Прокрутить вверх