Criticality:基于交互式批判性思维与循证推理痕迹的决策支持脚手架
决策需要检查底层假设和概念,考虑多元视角,并用清晰、准确的推理权衡潜在后果。最近的大型语言模型(LLM)有望通过结合推理能力与从大型文档中检索相关信息的能力来辅助决策者。然而,我们与五位专业决策者的形成性研究揭示了在工作流中使用LLM的关键限制:耗时的用户目标对齐、缺乏循证依据、过长输出、以及未浮出的假设,这些都削弱了用户对LLM输出和最终决策有效性的信任。我们引入Criticality,一个将Paul-Elder批判性思维框架操作化的系统,将推理结构化为交互式思维元素(如目的、假设、观点、含义),并使用智力标准(如清晰性、公平性、逻辑性)评估和指导推理。它还为每个主张检索证据,将其分类为支持、中立或矛盾,并解释主张-证据链接。一项将Criticality与ChatGPT 5 Pro(对话接口中最先进的推理模型)比较的Within-subjects研究(n=13)发现,Criticality改善了用户在决策过程中驾驭和修复推理的交互,产生了比基线更好的决策理由。
研究问题 / 现实痛点
这篇论文在当前问题库中对应的问题线索。
- 86%
学术问答系统中大语言模型错误评估的专家模式
CHI '26· 大语言模型(LLM)的人机协作 +2
- 86%
通过交互式解释接口提升人类对大语言模型推理的验证能力
IUI '26· 大语言模型(LLM)的人机协作 +2
- 75%
Perspectra:选择专家增强多智能体研究创意生成中的批判性思维
CHI '26· 大语言模型(LLM)的人机协作 +3
- 75%
Evalet: 通过功能碎片化评估大型语言模型
CHI '26· 大语言模型(LLM)的人机协作 +3
- 75%
PaperTrail:用于在基于LLM的学术问答中追溯 provenance 的声明-证据界面
CHI '26· 大语言模型(LLM)的人机协作 +3
- 75%
领域专家参与 LLM 设计和评估的关键考量:一项民族志研究
IUI '26· 大语言模型(LLM)的人机协作 +3
- 71%
AI of Oz:利用人工智能辅助人工Moderator增强人机交互中的Wizard of Oz研究
CHI '26· 大语言模型(LLM)的人机协作 +2
- 71%
基于大语言模型的临界论文阅读现场思考交流
IUI '26· 大语言模型(LLM)的人机协作 +2
- 71%
DiscipLink:通过人机协同探索促进跨学科信息寻求过程
UIST '24· 大语言模型(LLM)的人机协作 +2
- 67%
"我们是否要深入探讨?":为异步在线讨论中推进知识共建设计并评估LLM智能体策略
CHI '26· 大语言模型(LLM)的人机协作 +3
基于研究子主题与职业分类的 Jaccard 相似度(≥60%)