Использование ChatGPT в исследованиях взаимодействия человека и компьютера: вводный материал

Using ChatGPT for human–computer interaction research: a primer
Joost de Winter, Wilbert Tabone
2023-09-01

ChatGPTчеловеко-компьютерное взаимодействиеиерархическая суммаризацияанализ настроенийтекстовый анализ
ChatGPT может служить инструментом для текстового анализа в области взаимодействия человека и компьютера, однако его валидность требует проверки. В этом исследовании ChatGPT применяли к: (1) ответам в текстовых полях анкет по девяти интерфейсам дополненной реальности, (2) данным интервью участников, испытавших эти интерфейсы в виртуальном симуляторе, и (3) транскрибированным данным метода «думай вслух» у участников, которые рассматривали настоящую картину и её реплику. С использованием иерархического подхода ChatGPT формировал оценки или сводки для блоков текста, которые затем агрегировались. Результаты показали, что (1) ChatGPT генерировал оценки сентимента интерфейсов, которые крайне сильно коррелировали (r > 0.99) с результатами человеческих шкал оценок и с правилозависимым методом сентимент-анализа (критериальная валидность). Кроме того, (2) при вводе автоматически транскрибированных интервью в ChatGPT он предоставлял содержательные мета-резюме качеств интерфейсов (фасадная валидность). Одно из мета-резюме, проанализированное подробно, показало существенное, но неполное совпадение с контент-анализом, выполненным независимым исследователем (критериальная валидность). Наконец, (3) сводка ChatGPT по данным «думай вслух» выявила тонкие различия между настоящей картиной и репликой (фасадная валидность), что соотвествовало анализу ключевых слов (критериальная валидность). В заключение, наше исследование показывает, что при соблюдении надлежащих мер предосторожности ChatGPT можно использовать как валидный инструмент для анализа текстовых данных.
1
Детальное мета-резюме от ChatGPT показало существенное, но неидеальное совпадение с контент-анализом независимого исследователя, что подтверждает критерную валидность.
2
ChatGPT сгенерировал оценки сентимента для девяти интерфейсов дополненной реальности, которые коррелировали чрезвычайно сильно (r > 0.99) с оценками людей по шкале.
3
Оценки сентимента ChatGPT также чрезвычайно сильно коррелировали (r > 0.99) с методом правилового анализа сентимента, демонстрируя критерную валидность.
4
Резюме ChatGPT по данным «think-aloud» выявили тонкие различия между реальной картиной и репликой, соответствующие различиям, найденным с помощью анализа ключевых слов (face и criterion validity).
5
В целом, при соблюдении соответствующих предосторожностей ChatGPT может быть валидным инструментом для анализа текстовых данных в исследованиях человеко-компьютерного взаимодействия.
6
При вводе автоматически транскрибированных интервью ChatGPT создавал содержательные мета-резюме качеств интерфейсов, демонстрируя валидность по лицу (face validity).

ChatGPT, используемый как инструмент для анализа текстовых данных в исследованиях человеко‑компьютерного взаимодействия (ответы в текстовых полях анкеты, транскрипты интервью и транскрипты «think‑aloud»)

Достоверность и эффективность ChatGPT при формировании оценок сентимента, резюме и мета‑резюме текстовых данных в HCI, оценённые через критерийную и внешнюю валидность по сравнению с человеческими оценками, правиловыми методами анализа и контент/ключевым анализом

Publication Details
Publication Date
2023-09-01
Journal
Publisher
ISSN
Cited by
116
Access Type
Author Information
Authors
Joost de Winter
Wilbert Tabone
Explore further
Open the scid.ai AI chat with a ready-made request: it will find papers on a similar topic and help build a literature review.
Find similar papers in the chat
Make a presentation
100%