Mobile-Bench: оценочный бенчмарк для мобильных агентов на основе больших языковых моделей
Mobile-Bench: An Evaluation Benchmark for LLM-based Mobile Agents
2024-01-01
SCID: 54.1/6t5k5zv6
Discuss with AI
мобильные агенты на основе больших языковых моделейMobile-Benchоценочный бенчмаркбольшие языковые моделиоценка мобильных агентов
Figures from the paper
Abstract (AI)
Shihan Deng, Weikai Xu, Hongda Sun, Wei Liu, Tao Tan, Jianfeng Liu, Ang Li, Jian Luan, Bin Wang, Rui Yan, Shuo Shang. Материалы 62-го ежегодного собрания Ассоциации вычислительной лингвистики (том 1: большие статьи). 2024.
Key Findings
1
Конкретные сведения о дизайне бенчмарка, задачах, данных, метриках, экспериментальных результатах, сравнениях и ограничениях отсутствуют в предоставленном материале.
2
Статья называется Mobile-Bench и посвящена оценочному бенчмарку для мобильных агентов на основе больших языковых моделей; публикация состоялась на ACL 2024.
3
Предоставленный текст не содержит содержания аннотации, поэтому достоверно извлечь содержательные результаты исследования невозможно.
Research Object
мобильные агенты на основе больших языковых моделей (LLM)
Research Subject
оценочные характеристики и возможности мобильных агентов на основе больших языковых моделей (LLM) при выполнении мобильных задач
Publication Details
Publication Date
2024-01-01
Journal
Publisher
ISSN
Cited by
17
Open access PDF
Access Type
Author Information
Download PDF
Subscribe to digest