Безопасность агентного искусственного интеллекта: угрозы, методы защиты, оценка и открытые проблемы

Agentic AI Security: Threats, Defenses, Evaluation, and Open Challenges
Anshuman Chhabra, Shrestha Datta, Shahriar Kabir Nahin, Prasant Mohapatra
2026-01-01

безопасность агентного ИИавтономные агентыбольшие языковые моделиугрозы безопасностииспользование инструментов
Агентные системы искусственного интеллекта, работающие на основе больших языковых моделей (LLM) и обладающие возможностями планирования, использования инструментов, хранения памяти и автономной работы, становятся мощными и гибкими платформами автоматизации. Их способность автономно выполнять задачи в веб-среде, программном обеспечении и физических средах создает новые и усиленные риски безопасности, отличающиеся как от традиционной безопасности ИИ, так и от обычной безопасности программного обеспечения. В этом обзорном исследовании представлена таксономия угроз, специфичных для агентного ИИ, рассмотрены современные бенчмарки и методологии оценки, а также обсуждены стратегии защиты с технической точки зрения и с позиций управления. Мы обобщаем современные исследования и выделяем открытые проблемы, стремясь содействовать разработке агентных систем, изначально спроектированных с учетом требований безопасности.
1
Агентные ИИ-системы создают усиленные риски безопасности благодаря планированию, использованию инструментов, памяти и автономности в веб-, программных и физических средах.
2
Существующие меры защиты включают технические механизмы и стратегии управления, поддерживая подход к созданию агентов с безопасностью на этапе проектирования.
3
В безопасном развертывании и оценке автономных агентных систем сохраняются значительные нерешённые проблемы.
4
В обзоре разработана таксономия угроз, специфичных для агентного ИИ, а также рассмотрены соответствующие бенчмарки и методы оценки.
5
Эти риски отличаются как от традиционных проблем безопасности ИИ, так и от угроз обычной программной безопасности.

Агентные системы искусственного интеллекта на базе больших языковых моделей, обладающие планированием, использованием инструментов, памятью и автономностью

Угрозы безопасности, методы защиты, подходы к оценке и нерешённые проблемы, связанные с автономной работой агентного ИИ в веб-, программных и физических средах

Publication Details
Publication Date
2026-01-01
Journal
Publisher
ISSN
Cited by
12
Access Type
Author Information
Authors
Anshuman Chhabra
Shrestha Datta
Shahriar Kabir Nahin
Prasant Mohapatra
Explore further
Open the scid.ai AI chat with a ready-made request: it will find papers on a similar topic and help build a literature review.
Find similar papers in the chat
Make a presentation
100%