Eva Maxfield Brown 最新论文
Cuevas 等人通过399人实验比较LLM访谈聊天机器人与硬编码基线,发现LLM虽能产出高质量响应,但在捕捉参与者具体动机和个性化例子方面表现不足,人机评估信度也较低。
https://hci.top/zh/authors/39483?source=all