S1.08.1Risk-tiered machine translation设计

机器翻译适合大量低风险内容

别名: 机器翻译适用分级 · 原始机翻 · risk-based MT

概念解释

按风险分级使用机器翻译(risk-tiered machine translation)是依据误译后果、内容时效、目标读者与可恢复性,决定内容能否直接机翻、需要译后编辑,还是必须由专业人员翻译和审校。机器翻译的优势在于快速覆盖大量内容,不在于对所有内容提供相同质量。低风险通常意味着错误易被识别和纠正、不会改变权利或操作结果,并有清楚的反馈与升级路径。

机制

自动生成把边际处理时间降得很低,适合内容量大、更新快而人工翻译资源有限的场景。但模型根据统计模式生成最可能的译文,不会对产品事实、术语、否定、数字或语用后果承担责任。因而价值取决于“节省的人工工作”与“漏过错误造成的损失”之间的关系。知识库浏览、社区内容或内部理解稿可容忍一定不自然,只要用户知道内容来源并能查看原文;支付承诺、权限变化或应急指令则不能采用同一容错阈值。

边界

“大量”不是直接放行条件:重复出现的高风险错误会随规模一并放大。低风险也不等于低敏感度,未公开数据、个人信息,以及受许可、保密或合同处理限制的内容还要满足相应数据处理要求。语言资源稀缺、专业术语密集或模型不熟悉的语言对,即使内容后果不高,也可能因可理解性不足而失去价值。原始机翻应被标识为服务等级,而不是伪装成人工审校译文。

怎么落地

  • 用后果、受众、时效、可撤销性、数据敏感度和原文可见性给内容分级,并为每级指定原始机翻、轻度译后编辑、完整译后编辑或人工翻译。
  • 先在代表性语言与内容类型上抽样,记录致命错误、关键术语错误、任务完成率和用户投诉,而不是只看平均自动分数。
  • 对原始机翻提供来源标识、查看原文、报告问题和回退渠道;关键操作不要让用户只能依据未经审校的译文判断。
  • 持续监控内容域、模型、提示或术语库变更后的质量漂移;一旦错误超过该风险级的阈值,就提升人审等级或暂停发布。

延伸

  • 同组S1.08.2 界面短文案的错误率高于长文 · S1.08.3 法律、安全与医疗文案不得单靠机器翻译 · S1.08.4 译后编辑的成本需计入
  • 相邻S1.05 翻译上下文与字符串复用 · S1.07 面向翻译的写作
  • 站内检索risk-tiered machine translation · raw MT · translation quality level

同组卡片

快捷操作

分享

分享当前页面

ios_share

https://hci.top/zh/handbook/S1.08.1