ViseGPT: 实现 LLM 生成的数据整理脚本与用户提示的更好对齐
作者
大语言模型(LLM)的人机协作可解释人工智能(XAI)交互式数据可视化软件工程师与开发者HCI 研究员
大型语言模型(LLM)能够根据自然语言指令快速生成数据整理脚本,但这些脚本可能无法完全满足用户指定的要求,需要仔细检查和迭代优化。现有方法主要帮助用户理解脚本逻辑并自行发现问题,而非提供直接正确性验证。为提升调试效率并优化用户体验,我们开发了 ViseGPT 工具,可自动从用户提示中提取约束条件,生成全面的测试用例以验证脚本可靠性。测试结果随后被转换为定制的甘特图,使用户能够直观地评估与语义需求的一致性并迭代优化脚本。我们的设计决策基于一项探索用户实践和挑战的探索性研究(N=8)。我们还通过用户研究(N=18)评估了 ViseGPT 的有效性和可用性。结果表明,ViseGPT 显著提升了 LLM 生成的数据整理脚本的调试效率,增强了用户检测和修正问题的能力,并简化了工作流程体验。
研究问题 / 现实痛点
这篇论文在当前问题库中对应的问题线索。
当前问题库还没有收录这篇论文的问题与痛点。
- 71%
Lexara:用于评估对话式可视化分析中大语言模型的用户中心化工具包
CHI '26· 大语言模型(LLM)的人机协作 +2
- 67%
用于概念图的人机协作编辑工具
CHI '23· 大语言模型(LLM)的人机协作 +1
- 67%
促进对大型语言模型的适当依赖:解释、来源和不一致性的角色
CHI '25· 大语言模型(LLM)的人机协作 +1
- 67%
Wikipedia ORES Explorer:机器学习API应用设计权衡的可视化
DIS '21· 可解释人工智能(XAI) +1
- 67%
为何及何时基于LLM的助手会出错:基于提示的软件求助交互有效性研究
IUI '24· 大语言模型(LLM)的人机协作 +1
- 60%
MAPLE:利用大型语言模型嵌入的移动应用预测
UbiComp '24· 大语言模型(LLM)的人机协作
- 60%
LlamaTouch:一个可信且可扩展的移动UI任务自动化测试平台
UIST '24· 大语言模型(LLM)的人机协作
基于研究子主题与职业分类的 Jaccard 相似度(≥60%)
快捷操作
广告推荐
学习 AI 编程到 CodeNow
open_in_new打开DOI链接
DOI: https://doi.org/10.1145/3746059.3747689
一眼看懂
fact_check论文快照
dataset
来源
UIST
calendar_month
年份
2025
emoji_events
奖项
未标记奖项
group
作者
7 位作者
sell
研究子方向
大语言模型(LLM)的人机协作、可解释人工智能(XAI)、交互式数据可视化
work
职业/产业
软件工程师与开发者、HCI 研究员
article
内容状态
仅摘要
hub
相关论文
7 篇相关论文