谁验证验证者?将LLM辅助的LLM输出评估与人类偏好对齐

大语言模型(LLM)的人机协作软件工程师与开发者AI/ML 研究员与工程师HCI 研究员

由于人工评估的繁琐性以及基于代码的评估的局限性,大型语言模型(LLM)越来越多地被用于辅助人类评估LLM输出。然而,LLM生成的评估器简单地继承了它们所评估的LLM的所有问题,需要进一步的人工验证。我们提出了一种混合主动的方法来“验证验证者”——将LLM生成的评估功能(无论是提示还是代码)与人类需求对齐。我们的界面EvalGen为用户提供自动化的辅助,帮助生成评估标准并实现断言。在生成候选实现(Python函数、LLM评分提示)时,EvalGen让人类对一部分LLM输出进行评分;这种反馈被用于选择与用户评分更一致的实现。定性研究发现EvalGen总体上获得了支持,但强调了对齐的主观性和迭代性质。特别地,我们发现了一种被我们称为标准漂移的现象:用户需要标准来评估输出,但评估输出有助于用户定义标准。更重要的是,有些标准似乎依赖于观察到的特定LLM输出(在观察模型输出之前无法独立定义),这对于假设评估独立于模型输出观察的方法提出了严重问题。我们展示了我们的界面和实现细节、我们的算法与基线方法的比较,以及对未来LLM评估助手设计的启示。

快捷操作

分享

分享当前页面

ios_share

https://hci.top/zh/papers/uist/170954/2024

广告推荐

学习 AI 编程到 CodeNow

open_in_new打开DOI链接
DOI: https://doi.org/10.1145/3654777.3676450
一眼看懂

论文快照

fact_check
dataset
来源
UIST
calendar_month
年份
2024
emoji_events
奖项
未标记奖项
group
作者
5 位作者
sell
研究子方向
大语言模型(LLM)的人机协作
work
职业/产业
软件工程师与开发者、AI/ML 研究员与工程师、HCI 研究员
article
内容状态
仅摘要
hub
相关论文
10 篇相关论文