Новый вектор атак на системы искусственного интеллекта

Группа экспертов в области кибербезопасности представила результаты исследования, демонстрирующего уязвимость современных ИИ-агентов. Вместо традиционного внедрения вредоносных скриптов в программный код, злоумышленники могут использовать графические файлы для передачи скрытых команд.


Механизм скрытого воздействия

Суть метода заключается в том, что многие инструменты на базе искусственного интеллекта воспринимают изображения лишь как визуальное дополнение, не проводя глубокого анализа их структуры. В результате:

  • Инструкция внедряется в обычное на вид изображение.
  • Система считает такой запрос безопасным и игнорирует скрытую угрозу.
  • Активация вредоносного сценария происходит позже, при выполнении пользователем рутинных задач, например, при доработке функционала программы.

«К тому моменту ИИ-агент уже успевает “усвоить” скрытые указания, что позволяет злоумышленникам получить несанкционированный доступ к критически важным данным проекта и выдать их под видом легитимного кода», — отмечают исследователи.

Реакция ИИ-инструментов

Степень опасности данного метода варьируется в зависимости от архитектуры конкретного продукта. Согласно наблюдениям специалистов, реакция систем неоднородна: часть ИИ-инструментов без сомнений выполняла заложенные команды, тогда как другие системы распознавали аномалию и блокировали выполнение запроса.