理解用户对ChatGPT回答的不满:类型、解决策略与知识水平的影响

大语言模型(LLM)的人机协作算法公平与偏见软件工程师与开发者UI/UX 设计师AI/ML 研究员与工程师

具有聊天能力的大型语言模型(如ChatGPT)广泛应用于各种工作流程。然而,由于对这些大规模模型的有限理解,用户难以使用此技术并经历不同类型的不满。研究人员已引入了几种方法来改进模型响应,如提示工程。然而,他们专注于增强模型在特定任务中的性能,关于如何处理用户对模型响应产生的不满,则研究甚少。因此,以ChatGPT为案例研究,我们研究了用户的不满以及他们解决不满的策略。在根据文献综述将用户对LLM的不满组织为七类后,我们从107名用户那里收集了511个不满意的ChatGPT响应实例以及他们对不满意体验的详细回忆,并将其作为公开可访问的数据集发布。我们的分析表明,当ChatGPT未能理解用户意图时,用户经历不满的频率最高,而他们认为与准确性相关的不满严重程度最高。我们还确定了用户为解决不满而采用的四种策略及其有效性。我们发现用户通常不使用任何策略来解决不满,即使使用策略,72%的不满仍未得到解决。此外,我们发现低LLM知识水平的用户往往面临更多与准确性相关的不满,而他们在解决不满方面投入的努力通常较少。基于这些发现,我们提出了最小化用户不满和增强基于聊天的LLM可用性的设计含义。

快捷操作

分享

分享当前页面

ios_share

https://hci.top/zh/papers/iui/139201/2024

广告推荐

学习 AI 编程到 CodeNow

一眼看懂

论文快照

fact_check
dataset
来源
IUI
calendar_month
年份
2024
emoji_events
奖项
未标记奖项
group
作者
5 位作者
sell
研究子方向
大语言模型(LLM)的人机协作、算法公平与偏见
work
职业/产业
软件工程师与开发者、UI/UX 设计师、AI/ML 研究员与工程师
article
内容状态
仅摘要
hub
相关论文
10 篇相关论文