O1.02.2Field-level purpose specification设计研究
每个字段都需说明用途
别名: 字段级用途说明 · 数据字段清单 · data inventory
概念解释
字段级用途说明(field-level purpose specification)是为进入系统的每个数据字段建立可检查的功能目的,而不是用“改善体验”“业务需要”等宽泛理由覆盖整张表。说明应连接字段、处理动作、使用者和输出决定,使团队能判断该字段是否必要、能否被替代,以及用途结束后是否仍应存在。
机制
数据治理若只停留在数据集层级,新增列往往继承整张表的权限和模糊目的,久而久之形成无人能解释的“僵尸字段”。字段级映射迫使隐含依赖显性化,也让访问控制、删除和用户说明能够沿同一语义单元执行。它同时创造问责点:用途变化会表现为映射不匹配,而不是悄然被旧授权吸收。
怎么研究
可审计字段目录、查询日志与产品需求,抽样请字段所有者解释输入如何影响具体输出,再与真实代码路径比对。指标包括无负责人字段比例、声明用途与观察用途的一致率、长期未读字段、跨目的查询次数和解释者间一致性。访谈中的合理故事不是使用证据;需结合数据血缘和运行日志,且注意日志本身可能不完整。
边界
字段与用途不总是一对一:自由文本可能包含多个意外属性,原始传感器流也会支持尚未显式建模的推断。为每个字节写描述会造成虚假精确,合理粒度应与访问、风险和删除单位一致。安全研究或探索性分析可以保留较宽的假设空间,但仍需限定环境、期限和禁止用途,不能用“研究”作为永久通行证。
怎么落地
- 在模式注册时要求填写字段定义、来源、功能用途、读取者、输出、敏感级别与复核日期。
- 把“分析”“个性化”等抽象用途拆成可观察的产品动作,并标出可接受的替代输入。
- 让新查询和新共享自动关联字段目录;无法匹配用途时进入评审而非默认放行。
- 每季度抽样从界面动作追到查询,再从字段反向追到功能;删除无负责人、无读取或无法证明用途的字段,并验证依赖测试通过。