AI-агенты под угрозой: обзор ключевых проблем безопасности и перспективных направлений

AI Agents Under Threat: A Survey of Key Security Challenges and Future Pathways
Yang Xiang, Sheng Wen, Zehang Deng, Yongjian Guo, Changzhou Han, Wanlun Ma, Junwu Xiong
2025-02-07

AI агентывзаимодействие с ненадежными внешними сущностямиугрозы безопасностинепредсказуемость многошаговых пользовательских вводов
Агент в области искусственного интеллекта (AI) — это программная сущность, которая автономно выполняет задачи или принимает решения на основе заранее определённых целей и входных данных. AI-агенты, способные воспринимать пользовательские вводы, осуществлять рассуждения и планирование задач, а также выполнять действия, продемонстрировали заметный прогресс в развитии алгоритмов и повышении эффективности выполнения задач. Тем не менее проблемы безопасности, которые они создают, остаются недостаточно исследованными и нерешёнными. В данном обзоре рассматриваются возникающие угрозы безопасности для AI-агентов и классифицируются в четыре критических пробела в знаниях: непредсказуемость многошаговых пользовательских вводов, сложность внутренних исполнений, изменчивость рабочих сред и взаимодействия с недоверенными внешними сущностями. Систематически рассматривая эти угрозы, статья подчёркивает как достигнутый прогресс, так и существующие ограничения в обеспечении безопасности AI-агентов. Представленные в работе выводы призваны стимулировать дальнейшие исследования по устранению угроз безопасности, связанных с AI-агентами, и способствовать созданию более надёжных и защищённых приложений AI-агентов.
1
Агенты ИИ автономно выполняют восприятие, рассуждение, планирование и действия, однако их проблемы безопасности недостаточно изучены и не решены.
2
Выводы обзора нацелены на стимулирование дальнейших исследований для разработки более надежных и безопасных приложений агентов ИИ.
3
Статья систематически рассматривает существующие угрозы и выявляет как достижения, так и сохраняющиеся ограничения в защите агентов ИИ.
4
Обзор классифицирует угрозы безопасности агентов ИИ по четырем критическим пробелам знаний: непредсказуемость многошаговых пользовательских вводов, сложность внутренних исполнений, изменчивость рабочих сред и взаимодействия с недоверенными внешними субъектами.

Агенты искусственного интеллекта (ПО‑сущности, автономно воспринимающие, рассуждающие, планирующие и действующие)

Угрозы безопасности, уязвимости и проблемы защиты, влияющие на агентов ИИ, включая непредсказуемость при многошаговых пользовательских вводах, сложность внутренних выполнений, изменчивость рабочих сред и взаимодействия с ненадёжными внешними сущностями

Publication Details
Publication Date
2025-02-07
Journal
Publisher
ISSN
Cited by
183
Access Type
Author Information
Authors
Yang Xiang
Sheng Wen
Zehang Deng
Yongjian Guo
Changzhou Han
Wanlun Ma
Junwu Xiong
Explore further
Open the scid.ai AI chat with a ready-made request: it will find papers on a similar topic and help build a literature review.
Find similar papers in the chat
Make a presentation
100%