I1.07.4first-steady gap miscalibrates performance设计
首次与稳态响应若差异悬殊,用户会误判系统整体性能
别名: 性能误判 · 以第一下定调 · sampling error on speed
概念解释
第一次用 4 秒,后面都是 0.4 秒,人仍可能把产品记住为「慢」;反过来,第一下飞快、后来经常卡在 3 秒,人会说「不稳定」或「越用越慢」。首次与稳态差得太远时,整体性能会被误判:人拿一次或两次样本给整条产品定调,样本又恰好是分布里最不像的那两端。差异悬殊不是「有冷启动很正常」就能解释掉的体验问题,它是校准失败。
机制
整体印象是稀疏采样加峰值记忆。首次几乎一定被采到——没有首次就没有产品经验。稳态要很多次才进入印象。若首次是极端慢样本,峰值先写入「慢」,后面的快要反复出现才能改写。若首次是极端快样本,它写成「快」的锚,稳态里每一次回落到冷启动水平都被当成退步或故障。两种方向的鸿沟都让内部模型无法代表真实分布。
演示和评测最容易踩这个坑。销售现场的第一次被预热得像稳态,客户回去后的第一次是真冷启动,口碑按回家那一下定。实验室只测热路径,上线日志却充满每天的第一次。
边界
差异小(例如 1.2 倍)不会造成定调错误,人甚至感觉不到两段。差异大但首次发生在明确的「安装 / 更新后第一次打开」,人会把慢归因到安装,不一定归因到产品速度——前提是只有那一次,并且有「正在完成设置」之类的解释。每天打开都像首次那么慢,解释失效。专家会自己做热身(先随便点一下),误判发生在不热身的人身上。
怎么落地
- 把首次对稳态的倍数当成体验指标:超过大约两三倍,就要把首次拉近或把差异解释成可见的准备,而不是静默鸿沟。
- 对外演示和截图计时必须用冷启动,或明确标明「已预热」;用预热充当默认,会造成外部误判。
- 不要用稳态的数字做市场承诺。用户每天真正遇到的是第一次。
- 验证:两组人,一组冷启动后立刻做主任务,一组先预热再做。分别问「这个产品快吗」。若两组答案相反,鸿沟已经在替产品说话。把首次拉到与稳态同一量级,答案应收敛。