语义透视眼镜:在人工智能中穿戴语言虚拟现实
作者
Masaharu Hirose
Toyota Motor Corporation当语言被用作感觉信息的媒介时——比如用文字描述场景——一种虚拟现实应运而生:投影到同一句子中的现实变得虚拟/等价。我们称之为语言虚拟现实(LVR)。LVR主要由多数文化规范的代码构成。在当今世界——人工智能在很大程度上建立在语言数据和过程之上,并与日常感觉信息调解深度纠缠在一起——有必要批判性地重新审视这种VR的虚拟性。我们提出语义透视眼镜系统,作为第一人称体验,使语言调解场景中潜藏的LVR变得可见,从而能够直观地理解和分析其属性和问题。该系统在视频透视护目镜的摄像头和头戴式显示器之间插入了一个连续的图像到文本和文本到图像转换管道:实时视图被转换成单行文本,然后重新生成图像,只有这个经过调解的图像才能到达佩戴者的眼睛。我们构建了一个原型并验证了其基本属性,随后对佩戴者体验进行了定性分析。结果表明,这种方法能够主观体验——从而理解——由视觉的语言调解引起的环境信息转换及其伴随的问题。我们还获得了关于人工智能驱动的语言调解感觉信息和语言调解本身固有问题的初步见解。
研究问题 / 现实痛点
这篇论文在当前问题库中对应的问题线索。
- 86%
生成式AI的元认知需求与机遇
CHI '24· 生成式AI(文本、图像、音乐、视频) +2
- 71%
共同思考,更好地工作:结合人类和大语言模型的思维 aloud 结果进行有效的文本评估
CHI '25· 生成式AI(文本、图像、音乐、视频) +2
- 63%
“即使不是真实的我也开心”:生成式AI照片编辑作为记忆体验
CHI '26· 生成式AI(文本、图像、音乐、视频) +2
- 63%
LLM中的个人验证效应:积极AI响应虚构预测的有效性、可靠性、个性化与有用性偏见
CHI '26· 大语言模型(LLM)的人机协作 +2
- 63%
告诉我遗漏了什么:与GPT交互以回忆一次性目击事件
CHI '26· 大语言模型(LLM)的人机协作 +2
- 63%
协作强化学习综述:交互方法与设计模式
DIS '21· 大语言模型(LLM)的人机协作 +2
- 63%
PersonaFlow:设计基于LLM模拟专家视角的研究构思增强系统
DIS '25· 生成式AI(文本、图像、音乐、视频) +2
- 63%
探索预训练模型的创新机会
DIS '25· 生成式AI(文本、图像、音乐、视频) +2
- 63%
谁需要什么样的解释?用户特质如何影响人工智能辅助决策中解释的有效性
IUI '26· AI 辅助决策与自动化系统 +2
基于研究子主题与职业分类的 Jaccard 相似度(≥60%)