Исследования
Промпт-инъекции и отравление данных: как хакеры атакуют ИИ-агентов и как защититься
ИИ-агенты получают доступ к данным и инструментам, но вместе с автономностью появляются новые риски. Среди основных угроз — промпт-инъекции, когда злоумышленник внедряет вредоносные инструкции в запрос, и отравление данных, при котором модель обучается на искажённых примерах.
Также опасны атаки на цепочки инструментов (tool poisoning) и утечки контекста через системные промпты. Для защиты применяются изоляция агентов, строгая валидация входных данных, контроль доступа по принципу минимальных привилегий и мониторинг аномалий в поведении модели.
Понимание этих угроз критично для всех, кто внедряет ИИ-агентов в production. Без должной защиты автономность превращается в уязвимость.
Источник: habr.com