Ученые из Оксфордского университета показали, что искусственный интеллект нового поколения может быть уязвим для атак с помощью изображений, содержащих скрытые команды.

обои

Речь идет об ИИ-агентах – программах, которые в отличие от чат-ботов не только отвечают на вопросы, но и самостоятельно выполняют действия на компьютере: открывают вкладки, заполняют формы, управляют файлами. Чтобы “видеть” интерфейс, агенты делают скриншоты экрана и анализируют их. Исследователи выяснили, что в картинках, которые вы скачиваете в интернете, – от обоев рабочего стола до баннеров в соцсетях – можно спрятать команды, незаметные для человека, но распознаваемые ИИ.

“Скачанной измененной фотографии знаменитости в Твиттере может быть достаточно, чтобы запустить вредоносного агента на чьем-то компьютере”, – пояснил соавтор исследования Ярин Гал. По его словам, такая атака может привести к тому, что программа начнет делиться личными данными пользователя или заражать устройства других людей.

Исследователи на практике показали, что достаточно изменить всего несколько пикселей, чтобы агент выполнял действия, которых от него не просили: открывал сайты, пересылал данные или устанавливал дополнительные вредоносные программы. Для пользователя изображение при этом выглядит совершенно обычным.

Хотя случаев реальных атак пока не зафиксировано, исследователи призывают разработчиков учитывать уязвимость. “Это первый шаг к созданию защитных механизмов”, – отметил соавтор работы Адель Биби. По мнению специалистов, именно сейчас важно выработать меры безопасности, пока ИИ-агенты не стали массовым инструментом.

Тема киберугроз с использованием искусственного интеллекта становится все более актуальной. Эксперты обсуждают риски выхода ИИ из-под контроля и его возможное применение в кибератаках. Разработчики технологий призывают внедрять защитные протоколы параллельно с развитием новых моделей.