没有证据表明大语言模型在问题重构中是有用的
作者
AP
Anna Polyanskaya
Universidad del País Vasco大语言模型(LLM)的人机协作AI 辅助创意写作UI/UX 设计师HCI 研究员
研究背景与问题
作者发现了哪些问题或挑战?
- 问题重构(Problem Reframing)是设计人员必须面对的一项挑战,这要求他们创造新的、更有效的视角以重新定义设计问题。然而,这一过程复杂且费力,即使对于经验丰富的设计师也是如此。
- 作者提出,生成式大语言模型(LLMs)可以作为工具帮助设计师重构问题,但尚未有明确的实证研究表明其能显著提高问题框架的质量。
- 问题还包括经验丰富的设计师和不具有经验的设计师在使用 LLM 时的能力差距,以及 LLM 的使用可能影响设计师的感知代理性和创意所有权。
为什么这个问题很重要?
- 问题重构是设计实践的重要组成部分,缺乏有效问题框架会导致设计解决方案低效或甚至无用。因此,提升问题重构的质量是设计领域的关键。
- LLM 的普及和使用迅速增加,但设计人员并未完全了解其对创意潜能的影响,这可能导致误用或低效使用。
- 探明 LLM 对设计师是否有助益,对于人机协作和增强设计师能力具有重要意义。
研究动机与相关工作
- 当前研究表明,生成式 AI 可通过提供灵感或扩展想法来支持创意活动。然而,有关 LLM 在问题重构中的具体影响鲜有研究。
- 相关研究提出 LLM 在生成灵感方面有潜力,但也存在生成内容低质量或过于重复的问题。
- 作者提议结合设计师与 LLM 的协作研究,填补这一领域的知识空白,以探讨 LLM 是否能有效提升问题重构质量。
解决方案
作者提出了哪些方法或解决方案?
- 作者设计并比较了三种使用 LLM 的问题重构方法:
- 自由形式交互(Free-form Approach): 设计师通过自由对话与 LLM 进行交互。
- 直接生成框架(Direct Approach): LLM直接生成问题框架,设计师可以基于这些框架创建解决方案。
- 结构化流程(Structured Approach): 根据 Kees Dorst 的九步问题重构流程,通过逐步生成中间内容帮助设计师深入理解问题。
该解决方案的创新之处是什么?
- 独特地比较了自由交互、直接生成与结构化方法的效果,同时衡量 LLM 对设计师不同层次的专业能力和认知代理性的影响。
- 引入了结构化方法,将 Dorst 的问题重构九步流程与 LLM 结合,以支持设计师从更深层次分析问题。
- 将专家评估与大规模实验相结合,全面审视问题框架的质量和设计师的感知体验。
实施步骤是什么?使用了哪些关键技术?
- 构建实验设计: 随机分配参与者至四个条件(手动、直接生成、自由交互及结构化流程),确保研究方法的科学性。
- 生成设计问题: 准备三个具有适当重构难度的设计问题,确保参与者可以生成低质量和高质量的框架。
- 设计交互界面: 使用 LLM 的直接和结构化方法设计用户接口,通过按钮触发 LLM 生成内容,避免因参与者提示技术差异而导致结果偏差。
- 两阶段实验流程: 第一阶段收集问题框架,第二阶段由专家评估框架的质量。
- 数据分析: 包括框架的新颖性和实用性评分、LLM 的创造力支持指数(CSI),以及设计师的代理性和所有权感知。
研究成果
取得了哪些具体成果?
- 使用 LLM 并未显著提升问题框架在新颖性或实用性上的表现,其生成的框架质量与手动方法没有显著差异。
- 使用 LLM 增加了经验丰富设计师与非经验设计师之间的能力差距:前者生成了更具新颖性的问题框架,并具有更高的代理性感知。
- 自由交互方法和结构化方法的可靠性相近,未表现出显著的优势。
- 所有方法在 LLM 的创造力支持指数(CSI)中都被参与者评价为“良好支持”水平。
与现有解决方案相比,它有哪些优势?
- 提供了对 LLM 在复杂设计任务(如问题重构)中影响的首次系统性评估。
- 深入分析了设计师在与 LLM 交互时的感知体验,为未来设计透明且可靠的人机协作框架铺平了道路。
实验或评估结果是什么?
- 在新颖性和实用性评分上,LLM 方法与手动方法的框架得分没有显著差异。
- 专家评估发现经验丰富的设计师在使用 LLM 时创造出了更具新颖性的问题框架,较少经验的设计师则更容易受到低质量框架的影响。
- 使用结构化方法的设计师增加了感知代理性,尤其是设计专家。
局限性与未来方向
局限性:
- 实验仅限于 GPT-4o,可能不全面反映其他 LLM 模型的表现。
- 研究方法未覆盖所有可能的 LLM 使用场景,如将自由交互与结构化流程的结合。
- 评价指标聚焦于框架的新颖性和实用性,未考虑框架的其他潜在价值(如可操作性或多方共识)。
未来方向:
- 研究设计师如何具体利用 LLM 生成的框架,进一步寻找优化交互的方法。
- 探讨 LLM 影响问题框架其他质量特性的潜力,例如框架的说服力或适用性。
- 通过纵向研究,观察 LLM 在实际设计实践中对问题重构全生命周期的影响。
- 扩展研究样本至其他专业领域,以验证研究结果在不同上下文中的普适性。
总结
本文为设计领域提供了关于生成式 AI 在问题重构中的首次深入实证研究,明确了其优势和局限性。通过分析多种问题重构方法和设计师感知体验,本研究揭示了 LLM 使用同时带来的潜力与风险,也为进一步有效整合生成式 AI 的实际应用提供了新的方向。
研究问题 / 现实痛点
这篇论文在当前问题库中对应的问题线索。
help
研究问题
3- 生成式大型语言模型(LLMs)能显著提高设计中问题重构的质量吗?分类: AI/LLM 作为设计协作者与创意工具同类问题arrow_forward
- LLMs在设计问题重构中的影响是否会因设计师的经验水平不同而变化?分类: AI/LLM 作为设计协作者与创意工具同类问题arrow_forward
- 哪种LLM交互方法(自由交互、直接生成、结构化过程)在支持问题重构中最有效?分类: AI/LLM 作为设计协作者与创意工具同类问题arrow_forward
lightbulb
现实痛点
1- 设计师在重构问题时面临复杂且耗时的过程,结果质量难以保障。分类: AI/LLM 作为设计协作者与创意工具同类问题arrow_forward
- 75%
共创 AI 中交互动态的感知:Drawcto 中交互模态的比较研究
C&C '24· 大语言模型(LLM)的人机协作 +1
- 67%
以创作者为中心的大语言模型辅助交互式故事叙述方法探索
CHI '26· 大语言模型(LLM)的人机协作 +2
- 67%
研究写作专业人士与GenAI的关系:竞争与协作的组合感知如何塑造工作实践和成果
CHI '26· 大语言模型(LLM)的人机协作 +2
- 60%
从HCI研究中映射机器学习进展以揭示设计创新的起点
CHI '18· 大语言模型(LLM)的人机协作
- 60%
素描NLP:一个探索设计语言智能正确事物的案例研究
CHI '19· 大语言模型(LLM)的人机协作 +1
- 60%
输入效率和建议准确性影响单词建议的收益和采用
CHI '21· 大语言模型(LLM)的人机协作 +1
- 60%
CoAuthor:设计一个人工智能与人协作的写作数据集以探索语言模型的能力
CHI '22· 大语言模型(LLM)的人机协作 +1
- 60%
乐观主义:启用领域特定元启发式优化的协作实现
CHI '23· 生成式AI(文本、图像、音乐、视频) +1
- 60%
使用大型语言模型为UI草图生成自动反馈
CHI '24· 大语言模型(LLM)的人机协作 +1
- 60%
AXNav: 从自然语言重播可访问性测试
CHI '24· 语音可访问性 +1
基于研究子主题与职业分类的 Jaccard 相似度(≥60%)
快捷操作
广告推荐
学习 AI 编程到 CodeNow
open_in_new打开DOI链接
DOI: https://dl.acm.org/doi/10.1145/3706598.3713273
一眼看懂
fact_check论文快照
dataset
来源
CHI
calendar_month
年份
2025
emoji_events
奖项
未标记奖项
group
作者
4 位作者
sell
研究子方向
大语言模型(LLM)的人机协作、AI 辅助创意写作
work
职业/产业
UI/UX 设计师、HCI 研究员
article
内容状态
已索引正文
hub
相关论文
10 篇相关论文