Обзор глубокого обучения: концепции, архитектуры сверточных нейронных сетей, проблемы, применения и перспективные направления
Review of deep learning: concepts, CNN architectures, challenges, applications, future directions
2021-03-31
SCID: 54.1/5e7d8rhn
Discuss with AI
AlexNetархитектуры CNNсеть высокого разрешениясверточные нейронные сетиглубокое обучение
Figures from the paper
Abstract (AI)
В последние годы вычислительная парадигма глубокого обучения (DL) стала считаться золотым стандартом в сообществе машинного обучения (ML). Более того, она постепенно превратилась в наиболее широко используемый вычислительный подход в области ML, продемонстрировав выдающиеся результаты при решении ряда сложных когнитивных задач, сопоставимые с результатами человека или даже превосходящие их. Одним из преимуществ DL является способность обучаться на массивах данных огромного объема. В последние годы область DL быстро развивалась и широко применялась для успешного решения разнообразных традиционных задач. Что еще более важно, DL превзошло известные методы ML во многих областях, включая кибербезопасность, обработку естественного языка, биоинформатику, робототехнику и управление, обработку медицинской информации и многие другие. Несмотря на наличие ряда работ, посвященных обзору современного состояния DL, в них, как правило, рассматривается лишь один аспект этой области, что приводит к общему недостатку целостного представления о ней. Поэтому в данной работе предлагается более целостный подход, который должен обеспечить более подходную отправную точку для формирования всестороннего понимания DL. В частности, этот обзор направлен на предоставление комплексного анализа наиболее важных аспектов DL, включая недавно разработанные усовершенствования в данной области. В работе рассматривается значение DL, а также представлены типы методов и сетей глубокого обучения. Затем рассматриваются сверточные нейронные сети (CNN), наиболее широко используемый тип сетей глубокого обучения, и описывается развитие архитектур CNN вместе с их основными характеристиками — от сети AlexNet до сети высокого разрешения (High-Resolution Network, HRNet). Наконец, представлены проблемы и предложенные решения, призванные помочь исследователям понять существующие пробелы в исследованиях. Далее приводится перечень основных применений DL. Обобщаются вычислительные средства, включая программируемые вентильные матрицы (FPGA), графические процессоры (GPU) и центральные процессоры (CPU), а также описыва...
Key Findings
1
Свёрточные нейронные сети названы наиболее широко используемым типом сетей глубокого обучения; их архитектуры существенно развились от AlexNet до HR.Net.
2
Глубокое обучение способно работать с огромными массивами данных и превосходит традиционные методы машинного обучения в кибербезопасности, обработке естественного языка, биоинформатике, робототехнике и управлении, а также обработке медицинской информации.
3
Глубокое обучение стало доминирующей парадигмой машинного обучения, достигая человеческого или превосходящего человеческий уровня на многих сложных когнитивных задачах.
4
Работа выделяет нерешённые исследовательские пробелы и систематизирует проблемы и потенциальные решения, а также рассматривает вычислительные инструменты на базе FPGA, GPU и CPU.
5
Обзор предлагает целостное рассмотрение методов и сетей глубокого обучения, развития CNN от AlexNet до High-Resolution Network, приложений, вычислительных средств, проблем и предлагаемых решений.
Research Object
Парадигма глубокого обучения (DL) и её архитектуры, особенно сверточные нейронные сети (CNN)
Research Subject
концепции, развитие, особенности, проблемы, решения и применения глубокого обучения, особенно архитектур сверточных нейронных сетей
Publication Details
Publication Date
2021-03-31
Journal
Publisher
ISSN
Cited by
7896
Open access PDF
Access Type
Author Information
Download PDF
Subscribe to digest