J4.02.1searchable transcript设计研究
文字稿支持检索与快速浏览
别名: 文字稿 · 检索文字稿 · transcript · 全文稿
概念解释
文字稿(transcript)是一份可以搜索、可以扫读的完整文本。它的用处不是跟着画面一秒一行往下滚,而是让人在一小时材料里把那句报价、那个 API 名字、那条结论找出来。字幕一次只给几秒;稿把整场变成一篇文档。
机制
时间轴上的字占用工作记忆:看完下一句,上一句就从视野里消失,无法对全文做查找。空间化的文档允许眼睛跳标题、扫说话人轮次、用页面搜索命中字符串。成本差两个数量级:听完整期播客,对比在稿里键入一个专名。
屏幕阅读器用户也可以按文档结构跳,而不必把媒体当唯一线性通道听完。需要引用原话的人(记者、学生、客服核对承诺)依赖的是可复制的文本,不是字幕截图。检索成立的前提是稿在网页里是真文本,不是嵌在播放器里、搜索引擎和页内查找都进不去的一张图。
怎么研究
同一材料,一组只有字幕,一组有全文稿,布置查找任务:「报价数字在哪」「谁先提出延期」。不要把「点句子能否跳到那一秒」当成主因变量,那是对齐问题。
自变量:有无全文、有无小标题或说话人分段、稿是否为可选中文本。 因变量:找到目标的时间、漏检、错误命中(找到一段相似但不是目标的话)。
任务要埋在后半段,前几分钟就能看见的信息不区分两种介质。
边界
两秒的按钮音、验证码读数,检索没有意义,可见文字已经够。实时还没结束的对话没有终稿,检索的是一份会改的草稿。有些语音不能留下可检索副本(隐私、一次性口令),这时「可检索」会和「不留存」冲突,该删的是稿的留存,不是改去要求人们靠听。极短的社交语音若内容已被聊天里的字写过,再附一篇稿是重复。
怎么落地
- 在媒体页提供完整文字稿,作为页面上的真文本,而不是只挂一个播放器。
- 长内容按主题或说话人切开,让扫读有落点;页内搜索必须能命中稿里的词。
- 不要把稿做成图片或纯画布,复制和辅助技术都会失败。
- 验证:关掉播放器,只在文字里找一个埋在后半段的数字或专名,计时。必须把媒体听完才能找到,稿就还没承担检索。