AI-агенты под угрозой: обзор ключевых проблем безопасности и перспективных направлений
AI Agents Under Threat: A Survey of Key Security Challenges and Future Pathways
2025-02-07
SCID: 54.1/5rvx3qbu
Discuss with AI
AI агентывзаимодействие с ненадежными внешними сущностямиугрозы безопасностинепредсказуемость многошаговых пользовательских вводов
Figures from the paper
Abstract (AI)
Агент в области искусственного интеллекта (AI) — это программная сущность, которая автономно выполняет задачи или принимает решения на основе заранее определённых целей и входных данных. AI-агенты, способные воспринимать пользовательские вводы, осуществлять рассуждения и планирование задач, а также выполнять действия, продемонстрировали заметный прогресс в развитии алгоритмов и повышении эффективности выполнения задач. Тем не менее проблемы безопасности, которые они создают, остаются недостаточно исследованными и нерешёнными. В данном обзоре рассматриваются возникающие угрозы безопасности для AI-агентов и классифицируются в четыре критических пробела в знаниях: непредсказуемость многошаговых пользовательских вводов, сложность внутренних исполнений, изменчивость рабочих сред и взаимодействия с недоверенными внешними сущностями. Систематически рассматривая эти угрозы, статья подчёркивает как достигнутый прогресс, так и существующие ограничения в обеспечении безопасности AI-агентов. Представленные в работе выводы призваны стимулировать дальнейшие исследования по устранению угроз безопасности, связанных с AI-агентами, и способствовать созданию более надёжных и защищённых приложений AI-агентов.
Key Findings
1
Агенты ИИ автономно выполняют восприятие, рассуждение, планирование и действия, однако их проблемы безопасности недостаточно изучены и не решены.
2
Выводы обзора нацелены на стимулирование дальнейших исследований для разработки более надежных и безопасных приложений агентов ИИ.
3
Статья систематически рассматривает существующие угрозы и выявляет как достижения, так и сохраняющиеся ограничения в защите агентов ИИ.
4
Обзор классифицирует угрозы безопасности агентов ИИ по четырем критическим пробелам знаний: непредсказуемость многошаговых пользовательских вводов, сложность внутренних исполнений, изменчивость рабочих сред и взаимодействия с недоверенными внешними субъектами.
Research Object
Агенты искусственного интеллекта (ПО‑сущности, автономно воспринимающие, рассуждающие, планирующие и действующие)
Research Subject
Угрозы безопасности, уязвимости и проблемы защиты, влияющие на агентов ИИ, включая непредсказуемость при многошаговых пользовательских вводах, сложность внутренних выполнений, изменчивость рабочих сред и взаимодействия с ненадёжными внешними сущностями
Publication Details
Publication Date
2025-02-07
Journal
Publisher
ISSN
Cited by
183
Access Type
Author Information
Download PDF
Subscribe to digest
Источники этой статьи в scid.ai9
Обучение языковых моделей следованию инструкциям с использованием обратной связи от человека2022
Генеративные агенты: интерактивные симулякры человеческого поведения2023
Обзор безопасности и конфиденциальности больших языковых моделей (LLM): Хорошее, Плохое и Уродливое2024
От ChatGPT к ThreatGPT: влияние генеративного искусственного интеллекта на кибербезопасность и конфиденциальность2023
ChatGPT и рост крупных языковых моделей: новая угроза инфодемии, вызванной ИИ, для общественного здоровья2023
Дерево мыслей: целенаправленное решение задач с помощью больших языковых моделей2023
Дополнение извлечённой информацией снижает галлюцинации в диалогах2021
InjecAgent: бенчмаркинг косвенных внедрений промптов в агентных системах на основе больших языковых моделей с интеграцией инструментов2024
Краткий обзор векторных баз данных2023