从计算机使用中创建通用用户模型
荣誉提名作者
Shardul Sapkota
Stanford UniversityShan Rizvi
Independent ResearcherMichael S. Bernstein
Stanford University人机交互长期以来想象能够理解我们的技术——从我们的偏好和习惯,到我们日常行为的时间和目的。然而,当前的用户模型仍然是碎片化的,狭隘地针对特定应用,缺乏实现这些愿景所需的灵活跨上下文推理。本文提出了一种通用用户模型(GUM)架构,通过观察用户与计算机的任何交互来了解用户。GUM接受任何用户非结构化观察(例如设备截图)作为输入,并构建置信度加权的自然语言命题,捕捉该用户的行为、知识、信念和偏好。GUM可以推断用户正在准备参加他们将要参加的婚礼,通过与朋友的消息线程。或将识别用户正在努力处理合作者对草稿论文的反馈,通过观察多次停滞的编辑和转向阅读相关工作。GUM引入了一种从多模态观察中推断关于用户的新命题、检索相关命题作为上下文并持续修订现有命题的架构。为了说明GUM启用应用的广度,我们演示了它们如何通过上下文理解增强基于聊天的助手,管理操作系统通知以仅在需要时呈现重要信息,并使交互代理能够跨应用适应用户偏好。我们还实例化了一类新的主动助手(GUMBOs),根据用户的GUM为他们发现并执行有用的建议。在我们的评估中,我们发现GUM对用户做出了校准和准确的推断,并且构建在GUM上的助手主动识别并执行了用户不会明确要求的有意义价值的操作。总的来说,GUM引入了利用大型多模态模型理解非结构化用户上下文的新方法,实现了对人机交互的长期愿景和全新的预测用户需求的交互系统。
研究问题 / 现实痛点
这篇论文在当前问题库中对应的问题线索。
- 83%
从Gap到Synergy:通过人机协作增强个性化系统中的上下文理解
UIST '23· 大语言模型(LLM)的人机协作 +2
- 71%
基于LLM的搜索对决策制定的影响:速度、准确性和过度依赖
CHI '25· 大语言模型(LLM)的人机协作 +2
- 71%
理解配置AI在用户体验工作实践中的非使用情况的社会技术因素
CHI '25· 大语言模型(LLM)的人机协作 +2
- 71%
探索主动生成式AI智能体在时间紧迫的协作问题解决任务中的影响
CHI '26· 大语言模型(LLM)的人机协作 +2
- 71%
我的聊天机器人是否有议程?理解类人聊天机器人交互中的人类与人工智能主体性
CHI '26· 会话代理的人格与拟人化 +2
- 71%
迈向AI作为同事:多智能体系统改进结构化创意构思流程
CHI '26· 大语言模型(LLM)的人机协作 +2
- 71%
DuetUI:面向任务导向接口的人机协同生成双向上下文循环
CHI '26· 大语言模型(LLM)的人机协作 +2
- 71%
氛围检查:理解基于 LLM 的对话代理人格与对齐对目标导向任务中用户感知的影响
CHI '26· 会话代理的人格与拟人化 +2
- 71%
框架化「协作」:人机协作原则如何转化为 人机协作现实
CHI '26· 大语言模型(LLM)的人机协作 +2
- 71%
教学-学习交互:智能系统中支持反思性用户主体性的交互设计新概念
DIS '21· 大语言模型(LLM)的人机协作 +2
基于研究子主题与职业分类的 Jaccard 相似度(≥60%)