SemanticCommit:帮助用户大规模更新AI记忆的意图规范
作者
随着AI代理越来越依赖记忆系统来与用户意图保持一致,更新这些记忆面临着语义冲突和模糊性的挑战。借鉴软件工程中的影响分析,我们引入了 SemanticCommit,这是一种混合主动式界面,帮助用户将新意图整合到意图规范中——如 AI 记忆列表、Cursor Rules 和游戏设计文档等自然语言文档——同时保持一致性。SemanticCommit 使用基于知识图谱的检索增强生成管道检测潜在语义冲突,并在 LLM 支持下协助用户解决冲突。我们对12名参与者进行了一个被试内研究,将 SemanticCommit 与聊天文档基线(OpenAI Canvas)进行比较,发现工作流程存在差异:半數参与者在使用 SemanticCommit 时采用了影响分析工作流程,即他们首先标记冲突而不进行 AI 修改,然后在本地解决冲突,尽管可以访问全局修改功能。此外,用户觉得 SemanticCommit 提供了更强的控制感且不增加工作量。我们的发现表明,AI 代理界面应帮助用户独立于生成过程验证 AI 检索,表明改进控制带来的好处可以抵消手动审查的成本。本研究强调了 AI 系统设计者需要将更新记忆视为涉及人类反馈和决策的过程。
研究问题 / 现实痛点
这篇论文在当前问题库中对应的问题线索。
- 80%
AI Chains:通过链接大型语言模型提示实现透明且可控的人机交互
CHI '22· 大语言模型(LLM)的人机协作 +1
- 80%
在人工智能中介沟通中比较句子层面的建议和消息层面的建议
CHI '23· 大语言模型(LLM)的人机协作 +1
- 80%
VAL:使用GPT对话解析进行交互式任务学习
CHI '24· 大语言模型(LLM)的人机协作 +1
- 80%
需要帮助吗?为编程设计主动型AI助手
CHI '25· 大语言模型(LLM)的人机协作 +1
- 67%
ML模型文档的期望与实践:通过提示和可追溯性推动进展
CHI '23· AI 辅助决策与自动化系统 +2
- 67%
胜任但僵化:识别赋予AI平等参与群体决策能力的差距
CHI '23· 大语言模型(LLM)的人机协作 +1
- 67%
为什么约翰尼不能提示:非AI专家如何尝试(并失败)设计LLM提示
CHI '23· 大语言模型(LLM)的人机协作 +1
- 67%
行间阅读:建模AI辅助编程中的用户行为和成本
CHI '24· 大语言模型(LLM)的人机协作 +2
- 67%
从大规模交互痕迹中自动挖掘宏命令
CHI '24· 大语言模型(LLM)的人机协作 +1
- 67%
"如果机器和我一样好,那我还有什么用?" – 使用ChatGPT如何改变年轻专业人士对生产力和成就的看法
CHI '24· 大语言模型(LLM)的人机协作 +1
基于研究子主题与职业分类的 Jaccard 相似度(≥60%)