一言以蔽之:改进非视觉演示可访问性的反馈

视觉障碍者技术(屏幕阅读器、触觉图形、盲文)通用设计与包容性设计

文献标题

Say It All: Feedback for Improving Non-Visual Presentation Accessibility

文献信息

  • 主题领域: 无障碍技术与演示设计
  • 关键词: 无障碍演示, 实时反馈, 盲人可访问性, 图像描述, 语音视觉对齐, 用户研究

研究背景与问题

  • 问题与挑战:

    • 使用幻灯片作为支持的讲解中,视觉内容往往未被完整描述,影响了盲人和弱视观众的理解和参与。
    • 作者分析了90个演示视频(包含610个视觉元素),发现72%的视觉内容没有被充分描述。
    • 当前的无障碍演示指导方针缺乏具体工具支持,作者指出实际操作中存在较大难度,例如将抽象指导方针付诸实践。
  • 研究重要性:

    • 视觉演示是教育、研究和商业环境中传递信息的重要媒体,但如果无法让所有观众访问其内容,这种传递便不完整。
    • 提高幻灯片演示的无障碍性可以使盲人、弱视观众以及有其他环境限制的观众能够平等地接收到信息。
  • 研究动机与相关工作:

    • 受前期对无障碍媒体创作反馈工具和演示系统(如针对网页设计的无障碍工具Lift、WAVE)的启发,作者希望将这些方法引入幻灯片内容的实时和后续改进中。
    • 研究探索听觉与视觉内容对齐的算法和跨学科场景的学习效果,并结合文献中存在的无障碍演示指导(如VG1-7视听匹配简化规则)。

解决方案

  • 方法与解决方案:

    • 提出“Presentation A11y”,通过多种接口实现实时和后演示反馈:
      1. 实时反馈接口:
        • 对讲者的介绍内容进行实时语音转录,分析幻灯片上的视觉元素是否被涵盖。
        • 用高亮的方式提示未描述的幻灯片元素。
      2. 后演示反馈接口:
        • 提供逐页的内容摘要与具体建议,例如删除未提及的文本,简化过于复杂的媒体内容。
    • 系统使用光学字符识别(OCR)和标签生成算法对幻灯片中的文本和图像进行分类和标记。
  • 创新点:

    • 将无障碍指导的高层原则嵌入具体工具,提供元素层面的实时反馈和详细后续建议。
    • 提供语音和视觉内容的精确对齐支持,重点解决文本和媒体描述不足问题。
  • 实施步骤与技术:

    1. 对幻灯片进行DOM分析提取视觉元素。
    2. 使用谷歌云的实时语音转录功能和图片标签API,解析演示内容。
    3. 针对不同演示阶段(实时与后续),输出改进建议和文字元素描述评分。

研究成果

  • 具体成果:

    • 实验中,使用Presentation A11y的参与者对幻灯片内容覆盖率显著提高。
    • 与传统界面相比,文本覆盖率提升了11%,媒体覆盖率提高了25%。
    • 提供后演示反馈的情况下,参与者能够识别3.26倍之多的无障碍改进点。
  • 优势:

    • 辅助讲者更完整地描述视觉元素,增加了演示内容的可访问性。
    • 通过逐元素反馈提升了用户的注意力和改进目标定位。
  • 实验与评估:

    • 在一个16名参与者的用户研究中,系统被用于多种语境(课堂、会议、讲座)。
    • 定量数据表明,使用Presentation A11y显著提高了视障用户的自评演示无障碍性(平均评分从4.00提高到5.06)。
    • 定性反馈中,参与者评价认为系统增加了其无障碍意识,有助于优化讲述内容。
  • 局限性与未来方向:

    • 局限性:
      • 当前反馈界面主要面向视力正常用户,未完全服务于盲人和弱视讲者。
      • 对复杂媒体和具有高度语境化的内容,描述质量的量化仍然面临技术挑战。
    • 未来方向:
      • 开发对盲人作者友好的无障碍内容创作工具。
      • 将系统扩展至物理环境中的混合演示(如使用手势、与观众互动)。
      • 深化图像分析技术,加强复杂媒体的自动化反馈能力(如应用DenseCap生成更丰富内容描述)。

快捷操作

分享

分享当前页面

ios_share

https://hci.top/zh/papers/chi/47369/2021

广告推荐

学习 AI 编程到 CodeNow

open_in_new打开DOI链接
DOI: https://doi.org/10.1145/3411764.3445572
一眼看懂

论文快照

fact_check
dataset
来源
CHI
calendar_month
年份
2021
emoji_events
奖项
未标记奖项
group
作者
4 位作者
sell
研究子方向
视觉障碍者技术(屏幕阅读器、触觉图形、盲文)、通用设计与包容性设计
work
职业/产业
—
article
内容状态
已索引正文
hub
相关论文
3 篇相关论文