Tyche:理解基于属性的测试有效性
作者
可解释人工智能(XAI)交互式数据可视化时序数据与网络图可视化软件工程师与开发者数据科学家与分析师AI/ML 研究员与工程师
软件开发者越来越多地依赖自动化方法来评估代码的正确性。其中一种方法是属性基测试(PBT),测试工具生成数百或数千个输入,并使用参数化属性检查程序在这些输入上的输出。虽然功能强大,但PBT引发了相当大的评估鸿沟:开发者需要付出大量努力来理解不同测试输入对被测软件的测试效果。为了弥合这一鸿沟,我们提出了Tyche,一个支持属性基测试有效性理解的用户界面。通过形成性设计探索,Tyche的设计为开发者提供与现代开发者测试工作流紧密集成的测试行为交互式、可配置视图。这些视图帮助开发者探索全局测试行为和单个测试输入。为加速开发强大的交互式PBT工具,我们定义了PBT测试报告标准并将其与广泛使用的PBT库集成。一项自导式在线可用性研究显示,Tyche的可视化帮助开发者更准确地评估软件测试有效性。
研究问题 / 现实痛点
这篇论文在当前问题库中对应的问题线索。
当前问题库还没有收录这篇论文的问题与痛点。
- 71%
PleaSQLarify:面向自然语言数据库查询的视觉语用修复
CHI '26· 大语言模型(LLM)的人机协作 +2
- 71%
XAutoML:用于理解和验证自动化机器学习的可视化分析工具
IUI '24· 可解释人工智能(XAI) +2
- 71%
SCSimulator:一种基于大语言模型多智能体模拟的供应链合作伙伴选择探索性可视化分析框架
IUI '26· 大语言模型(LLM)的人机协作 +2
- 71%
基于交互式任务分解的AI辅助数据分析引导与验证改进
UIST '24· 大语言模型(LLM)的人机协作 +2
- 67%
将AI引入BI:在现代商业智能平台中启用非结构化数据的可视化分析
CHI '18· 可解释人工智能(XAI) +1
- 67%
FDHelper:通过交互式特征选择和评估辅助无监督欺诈检测专家
CHI '20· 可解释人工智能(XAI) +1
- 67%
mTSeer:多变量时间序列预测的模型交互式可视化探索
CHI '21· 交互式数据可视化 +1
- 63%
由大型语言模型驱动的可视化自然语言数据集生成框架
CHI '24· 大语言模型(LLM)的人机协作 +2
- 63%
VeriPlan:将正式验证和大语言模型集成到终端用户规划中
CHI '25· 大语言模型(LLM)的人机协作 +2
- 63%
Lexara:用于评估对话式可视化分析中大语言模型的用户中心化工具包
CHI '26· 大语言模型(LLM)的人机协作 +2
基于研究子主题与职业分类的 Jaccard 相似度(≥60%)
快捷操作
广告推荐
学习 AI 编程到 CodeNow
open_in_new打开DOI链接
DOI: https://doi.org/10.1145/3654777.3676407
一眼看懂
fact_check论文快照
dataset
来源
UIST
calendar_month
年份
2024
emoji_events
奖项
未标记奖项
group
作者
5 位作者
sell
研究子方向
可解释人工智能(XAI)、交互式数据可视化、时序数据与网络图可视化
work
职业/产业
软件工程师与开发者、数据科学家与分析师、AI/ML 研究员与工程师
article
内容状态
仅摘要
hub
相关论文
10 篇相关论文