T1.06.3Context-aware mixed-script punctuation设计研究

中英文标点混用会破坏节奏

别名: 中英标点混用 · 全角半角 · CJK 标点 · mixed-script punctuation

概念解释

情境感知的混合文字标点(context-aware mixed-script punctuation)区分无意把中文与英文标点体例混在同一话语层级,和为英文引语、代码、品牌、URL 或结构化数据保留原样的合法嵌入。中文主句通常采用与中文排版匹配的标点,纯英文片段遵循英文规则;但“主句语言决定全部符号”仍过于粗糙。判断还要看片段边界、标点归属、locale 风格及内容是否具有机器语义。

机制

全角与半角只是可见线索,真正差异还涉及字形位置、前后空白、禁则与换行、字体选择和嵌套引号。未经控制的混用会让停顿宽度、基线和行尾规则变化,也可能在占位符插入后出现重复空格、孤立标点或错误断行。反之,盲目归一化会破坏代码、邮箱、版本号和品牌拼写,或把完整英文引语改成不合其语法的符号。可靠处理需让模板知道外层语言、嵌入片段类型与标点归属,并交给目标 locale 的排版规则渲染。

怎么研究

构造外层中文/英文 × 嵌入类型 × 标点位置 × 换行条件矩阵,覆盖普通词、完整引语、括号、数字、代码、URL、品牌、动态变量和 RTL 片段。由母语审阅者标注错误与合法嵌入,再测阅读分段、误读、查找时间及版面缺陷;视觉测试还需记录字体、平台、窄宽度和缩放。对 lint 或自动修复器应分别报告命中精度、错误转换和漏掉的 spacing/line-break 问题,不能以半角标点出现次数直接代表质量。

边界

混合文字本身不是错误,“使用 Apple ID 登录”、英文书名、用户原文和经批准品牌写法都可保留。代码、命令、路径、邮箱、URL、版本和机器可读标识必须保持字面符号;数学、学术与行业格式也可能有专门规范。日文、韩文、繁简中文及不同地区中文的标点和空白习惯不能合并为一套“中国规则”。字体渲染异常或错误换行也不一定来自文案字符,仍需检查 font fallback 与排版引擎。

怎么落地

  • 为目标 locale 记录主句、引语、括号、列表、数字和嵌入外语的标点/空白/换行规则;模板标注片段类型和语言,不仅保存一段无结构字符串。
  • 在资源与运行时 lint 中查找可疑全半角、重复空白、行首行尾禁则和占位符两侧标点;把代码、URL、品牌、用户内容与结构化字段作为带类型节点排除,而非脆弱文本白名单。
  • 禁止无上下文批量替换。自动修复只处理规则确定的范围,其余交母语编辑;完整引语与短词嵌入分别评审,不能共享一个“随主句”开关。
  • 在生产字体、窄屏、缩放、复制粘贴和读屏下检查 spacing、line break、字体切换与朗读停顿;回归用例同时保存 locale、字体、模板和变量值。

延伸

  • 同组T1.06.1 标题大小写规则需统一 · T1.06.2 句末标点在短标签中通常省略 · T1.06.4 感叹号的使用需要预算
  • 相邻S1.03.1 字体缺字会触发回退并改变版面 · S1.06.3 应使用带占位符的完整句模板
  • 站内检索mixed-script punctuation · CJK punctuation · full-width half-width

同组卡片

快捷操作

分享

分享当前页面

ios_share

https://hci.top/zh/handbook/T1.06.3