违规行为一旦未产生不良后果,会被正强化并更频繁重复
别名: 间歇性强化 · positive reinforcement of deviance
概念解释
违规和它的后果之间存在一个不对称的反馈关系:只要偏离规则的那一次没有立刻出事,操作者得到的实际反馈是"这样做没问题、还更快"——这个反馈本身就是一种奖励,会让同样的偏离在下一次更容易被重复;而真正的坏后果只在小概率的失败情况下才会出现,大多数时候违规者收到的是清一色的正向信号。
机制
这是一种典型的间歇性强化(intermittent reinforcement)结构:好处(省时间、省力气)几乎每次都兑现,坏处只在偶尔的、低概率的情况下才出现。这种"经常有好处、极少有坏处"的反馈模式,恰恰是最容易让一个行为被固化下来的强化方式,比"每次都有好处"或"每次都有坏处"的行为更难通过一次警示或一次处罚来纠正,因为绝大多数的实际经历都在告诉操作者"这样做是对的"。
边界
这个机制解释的是违规为什么会被维持和扩散,不解释违规最初为什么会出现——最初的起因通常是规则不现实或情境压力。它也不意味着严惩能反过来纠正这种维持机制:只要事故发生的概率仍然很低,个体经历"被惩罚"的次数也会远少于经历"没出事、还更快"的次数,处罚本身同样淹没在这套间歇性强化结构里,很难单靠加大处罚力度去对抗大量正向经历积累出的行为倾向。
怎么落地
不要等到事故发生才去关注某个违规行为——只要观测到某个偏离已经在被重复、且没有造成可见后果,就应该判断它已经进入了被正强化的阶段,此时的干预重点是让偏离的实际成本变得可感知(比如把因偏离而降低的安全裕度用可见的方式呈现出来,而不是让它一直隐藏在"这次没出事"的表象下),而不是等待一次真正的事故来提供"教训"。验证办法:跟踪一个已知偏离行为的重复频次随时间的变化,如果频次持续上升且没有对应的负反馈介入,说明它正处在被正强化、会继续扩散的轨道上,需要在事故发生前主动介入,而不是把"还没出事"当作暂时可以不管的理由。