流式传输,快与慢:认知负载感知的流式传输实现高效LLM服务
生成式AI(文本、图像、音乐、视频)大语言模型(LLM)的人机协作AI/ML 研究员与工程师统计学家与数据科学家
由大型语言模型(LLMs)驱动的生成式对话界面通常以计算预算决定的速率逐个token流式输出输出内容,往往忽略了实际的人类阅读速度和与内容相关的认知负载。这种不匹配经常导致计算资源使用效率低下。例如,在云服务中,以超过用户阅读速度流式传输内容似乎是不必要的,导致计算资源浪费并可能给其他用户带来延迟,特别是在高峰使用期。为了解决这个问题,我们提出了一种自适应流式传输方法,根据推断的认知负载实时动态调整LLM流式输出的节奏。我们的方法估计与流式内容相关的认知负载,并在复杂或信息丰富的片段战略性地放慢流速,从而释放其他用户的计算资源。我们进行了统计分析 和基于从针对各种LLM生成内容的众包用户研究中收集的数据得出的统计模型的模拟。我们的结果表明,这种自适应方法可以有效减少计算消耗,同时在很大程度上保持流式速度高于用户的正常阅读速度。
研究问题 / 现实痛点
这篇论文在当前问题库中对应的问题线索。
当前问题库还没有收录这篇论文的问题与痛点。
- 60%
使用生成语言模型发现自然语言编程的语法和策略
CHI '22· 生成式AI(文本、图像、音乐、视频) +1
- 60%
《它想让我怎么说》:弥合最终用户程序员与代码生成大型语言模型之间的抽象差距
CHI '23· 生成式AI(文本、图像、音乐、视频) +1
- 60%
通过有效验证LLM标签实现人类-LLM协作注释
CHI '24· 大语言模型(LLM)的人机协作 +1
- 60%
IntentTuner:将人类意图整合到文本到图像生成模型微调中的交互框架
CHI '24· 生成式AI(文本、图像、音乐、视频) +1
- 60%
创造性的合作?用户对AI创造力的误判影响他们的合作表现
CHI '25· 生成式AI(文本、图像、音乐、视频) +1
- 60%
AI仪器:将提示作为工具来抽象和反映图形界面命令作为通用工具
CHI '25· 生成式AI(文本、图像、音乐、视频) +1
- 60%
D-Twins:专为实时无聊干预设计的数字双胞胎
CHI '25· 生成式AI(文本、图像、音乐、视频) +1
- 60%
寻找对话:一种为自然对话内容评分文档的方法
CHI '25· 生成式AI(文本、图像、音乐、视频) +1
- 60%
流动变换器与创造性类比:探索大型语言模型增强跨领域类比创造力的能力
C&C '23· 生成式AI(文本、图像、音乐、视频) +1
- 60%
接受、拒绝还是修正:人机协作中生产力与信任的度量
IUI '24· 生成式AI(文本、图像、音乐、视频) +1
基于研究子主题与职业分类的 Jaccard 相似度(≥60%)
快捷操作
广告推荐
学习 AI 编程到 CodeNow
open_in_new打开DOI链接
DOI: https://doi.org/10.1145/3746059.3747721
一眼看懂
fact_check论文快照
dataset
来源
UIST
calendar_month
年份
2025
emoji_events
奖项
未标记奖项
group
作者
2 位作者
sell
研究子方向
生成式AI(文本、图像、音乐、视频)、大语言模型(LLM)的人机协作
work
职业/产业
AI/ML 研究员与工程师、统计学家与数据科学家
article
内容状态
仅摘要
hub
相关论文
10 篇相关论文