Mobile-Bench: оценочный бенчмарк для мобильных агентов на основе больших языковых моделей

Mobile-Bench: An Evaluation Benchmark for LLM-based Mobile Agents
Shihan Deng, Weikai Xu, Hongda Sun, Wei Liu, Tao Tan, Liujianfeng Liujianfeng, Ang Li, Jian Luan, Bin Wang, Rui Yan, Shuo Shang
2024-01-01

мобильные агенты на основе больших языковых моделейMobile-Benchоценочный бенчмаркбольшие языковые моделиоценка мобильных агентов
Shihan Deng, Weikai Xu, Hongda Sun, Wei Liu, Tao Tan, Jianfeng Liu, Ang Li, Jian Luan, Bin Wang, Rui Yan, Shuo Shang. Материалы 62-го ежегодного собрания Ассоциации вычислительной лингвистики (том 1: большие статьи). 2024.
1
Конкретные сведения о дизайне бенчмарка, задачах, данных, метриках, экспериментальных результатах, сравнениях и ограничениях отсутствуют в предоставленном материале.
2
Статья называется Mobile-Bench и посвящена оценочному бенчмарку для мобильных агентов на основе больших языковых моделей; публикация состоялась на ACL 2024.
3
Предоставленный текст не содержит содержания аннотации, поэтому достоверно извлечь содержательные результаты исследования невозможно.

мобильные агенты на основе больших языковых моделей (LLM)

оценочные характеристики и возможности мобильных агентов на основе больших языковых моделей (LLM) при выполнении мобильных задач

Publication Details
Publication Date
2024-01-01
Journal
Publisher
ISSN
Cited by
17
Access Type
Author Information
Authors
Shihan Deng
Weikai Xu
Hongda Sun
Wei Liu
Tao Tan
Liujianfeng Liujianfeng
Ang Li
Jian Luan
Bin Wang
Rui Yan
Shuo Shang
Explore further
Open the scid.ai AI chat with a ready-made request: it will find papers on a similar topic and help build a literature review.
Find similar papers in the chat
Make a presentation
100%