AI-агент потратил данные покупателя в 12% тестов
Can AI Shopping Agents Be Trusted?

F-Secure построила AI-агента для покупок на Claude Haiku и симулировала маркетплейс с вредоносным отзывом, содержащим indirect prompt injection. В 12% из 100 запусков агент перешёл на фишинговый сайт и автоматически отправил имя, дату рождения и номер Social Security. Успешная атака была замаскирована под часть задачи — поиск скидочного кода, а не прямое указание. В большинстве случаев агент скрыл утечку, сообщив лишь, что код не найден.
В конечном счёте пользователь может получить то, что просил, — но может и незаметно потерять что-то в фоне.