机制笔记 · 强化程式与关系粘性

创伤性关系的
粘性机制

一段客观上更糟的关系,往往比一段客观上更好的关系更难脱身。如果粘性来自"关系的好",这不可能发生。

01

入口

先破一个前提。进入一段创伤性关系,不需要任何病理性因素。不需要低自尊、不需要识人不清、不需要"喜欢受苦"。以下每一条都是正常机制,任何一条都足够构成入口。

时序错位:吸引先于信息

吸引在信息不全时发生,而创伤性特征通常是渐进暴露的。一旦投入启动,评估机制就被污染:已投入的系统会给不利信息打折、给有利信息加权。

所以"我知道了但没走"不是意志薄弱,是评估器已被接管

渐变:在入口处,它还不是创伤性的

几乎没有人是"选择"进入一段创伤性关系的。创伤性通常逐步升级,而每一步的增量都小到不构成离开的理由。同时基线在持续移动——上一轮的极端变成这一轮的正常。

事后那句"我怎么会容忍这个",是拿现在的基线去衡量当时的基线。两者不是同一把尺子。

熟悉感偏好

早期关系经验会形成"关系应该是什么样"的默认模板。在不稳定环境中长大的人,对不稳定信号有熟悉感,稳定反而引发不适或无聊。

不是"喜欢受苦",是模式识别把熟悉误判成了合适。

结构性绑定(必须和粘性分开)

经济、居住、子女、共同事业、社会关系网——这些提高退出成本,但不制造引力。它们是约束,不是粘性。

为什么这个区分要紧

约束可以被计算和解决(钱、住处、法律),粘性不能——粘性是即使所有约束都消失,人还是想回去。

误把粘性当约束,会以为"等我经济独立了就能走",然后发现走不了。

小结

以上任何一条都不是必要条件。下一节的机制一旦启动,不需要特殊的入口,也不需要特殊的人。它作用于所有人,不挑对象。

02

为什么粘:四重机制叠加

四条机制独立成立,叠加后的粘性远超任何单一因素。

第一重 · 间歇强化

实验来源

Skinner 与 Ferster 关于强化程式的系统研究(1957)。行为主义最扎实的实验遗产之一。

程式规则反应率消退抵抗
固定比率每 N 次给一次高,给完有停顿
可变比率平均 N 次给一次,不可预测最高,稳定无停顿最强
固定间隔每隔 T 时间给一次低,临近才加速
可变间隔平均 T 时间给一次,不可预测中等,非常稳定

具体形状

鸽子按键取食。连续强化组(每次都给)在停止供食后,通常几十次反应内放弃;可变比率组(随机给)在停止供食后,可持续成百上千次反应。

两组面对的是同一件事:按了,没有食物。一组很快认定"没了",另一组坚持到不成比例。技术名称是部分强化消退效应

FIG. 1同样是"不再给",两种程式的消退完全不同
强化停止 时间 →
  • 可变比率(不可预测):先爆发,再长期缓慢下降,画面里始终没有归零
  • 连续强化(每次都给):短暂一顿,随即迅速归零
  • 虚线=两条线同时失去供给的时刻
两条线在同一时刻失去供给。差别不在它们曾经给了多少,而在给得可不可预测。更不可靠的那一条,反而拖得更久。

日常同构物:自动售货机 vs 老虎机

自动售货机=连续强化。投币必出货。所以第一次不出货,你立刻停止投币,还会拍机器——快速消退加强烈挫败。

老虎机=可变比率。不出奖是正常的。所以你继续投,能投一整晚——极端抗消退。

两台机器都在"不给你东西",你的行为却完全相反。

为什么这套机制被焊得这么深

自然界的资源大多间歇可得。一个觅食动物如果试一次没找到就放弃,会饿死。在不确定回报面前保持坚持,有生存价值。它不是缺陷,是被选出来的功能,只是在现代环境里被老虎机和某些关系精确利用了。

第一重的推论

人不是被那些"好"留住的,是被好的不可预测留住的。

稳定给予 → 预测误差趋近于零 → 信号弱。不可预测的给予 → 每次都是正的预测误差 → 信号强。所以稳定对你好的人粘性弱,时好时坏的人粘性强——这不是因为后者更爱你,或你更爱他。

Dutton & Painter(1981)提出的创伤性联结认为,最强粘性出现在两个条件同时满足时:权力不对等,加上间歇性的好坏交替。第二条正是可变比率。

第二重 · 系统收不到"结束"信号

稳定的关系一断,立刻知道"没了",于是开始哀伤和代谢。而本来就时有时无的关系,消失一段时间完全在正常波动范围内

所以系统一直在等下一次——按过去的经验,等一等真的会有。

第二重的推论

"断不掉"不是意志问题,是系统从结构上收不到终止信号

对照实验:连续强化组的鸽子能判断出供食停止了;可变比率组判断不出来,因为空手而归本来就是常态。

第三重 · 解题回路

一旦开始"尝试理解和改变对方",就接入了第二条独立的上瘾回路

我调整 → 观察反应 → 有时好转(强化) → 有时无效(不强化)→ 继续调整

这个循环本身就是可变比率的形状。于是粘住人的不再只是关系,还有"我快解决它了"这个过程。

倾向类型不舒服的含义结果
感受主导撤退信号更容易离开
分析主导"还没搞懂"的提示音更容易留下

而且它提供体面的说法:"我不是放不下,我是还没想清楚。"赤裸的沉陷——我就是舍不得——反而更容易被认出来。

第四重 · 身份绑定

前三重解释的都是"对方的给予如何拴住人"。这一重不同:它不需要对方给任何东西。

关系里的角色会沉淀成自我定义的一部分——我是那个稳定给予的人、那个看得懂他的人、那个不放弃的人。于是每一次付出,除了指向对方,还在确认一个身份。变体很多,结构相同:给予者/拯救者;"我不是半途而废的人";"我们的感情是特别的,别人不懂"。

关键性质:这一重的奖赏是连续且保证的

前三重都依赖对方偶尔给点什么。这一重的供给来自你自己:只要你还在给,那个身份就成立,与对方是否回应无关。由此产生一个反转——

机制对方的糟糕是什么
第一至三重被容忍的成本
第四重原料
第四重的推论

对方越是辜负、越是不领情,"我依然在给"这件事就越鲜明。关系越糟,身份越成立。

这解释了一类前三重完全覆盖不到的情形:一段没有忽冷忽热、只有稳定的糟糕的关系,照样极难脱身。因为拴住人的不是那个人给的东西,是那个角色给的东西。

为什么这一重最难被看见

它伪装成美德。前三重被识破时,人会感到羞耻——我怎么这么上瘾。第四重被识破时,人会感到被冒犯——因为你质疑的不是他的判断,是他的品格。

03

为什么理性无效

要解释的不是"当事人看不清"。恰恰相反,当事人通常看得很清楚。要解释的是:为什么看清了也不动。

认知和奖赏是不同层级

能准确说出"我知道他不是个好人",和有动力离开,是两回事。清楚不构成动力。

临床上这是老问题:单纯的洞察导向工作,经常产生"对自己的问题理解得极其透彻,行为一点没变"。

状态依赖:洞察在需要它的时刻不可调用

清醒的判断在低唤起状态下生成——独处、事后、冷静时。而需要用到它的时刻是高唤起状态——对方发来消息、见面、争吵后的和好、突然的示好。

两个状态之间存在访问障碍:平静时写下的结论,在被激活时调不出来,或者调出来了也没有分量。

所以反复"想清楚"改变不了什么——不是想得不够透,是想清楚这件事发生在错误的状态里

认知失调反向工作

为留下而生成的解释,本身会加强留下的倾向。

已经投入很多 → 需要证明投入值得 → 生成解释 ("他其实是爱我的"/"他只是有创伤") → 解释成为新的留下理由 → 更难走

这是效力合理化:付出越大,越需要相信对象值得,而这个相信是自己生产的,不是对方给的。

最反直觉的一条

"努力去理解对方"不是通向清醒的路,是通向更深绑定的路。越理解,越走不掉。

间歇强化诱发"迷信式解释"

Skinner 1948 年的附带实验"鸽子的迷信":不管鸽子在做什么,都按固定时间随机给食。鸽子会把当时碰巧在做的动作当成原因,然后反复重复它。

人在不可预测的关系里做同样的事。当事人会建构一套关于"什么时候他会好"的理论——我这样说话他就好、我不逼他他就好、我给他空间他就好。而这些理论会偶尔被验证,因为"好"本来就随机出现。偶尔的验证,恰好又是可变比率强化。

由此产生的关键幻觉

当事人不但不觉得失控,反而觉得自己"越来越懂怎么处理他"。

掌控感是被间歇强化亲手制造的,而它成了留下的又一个理由。

推论:外部分析同样无效

以上机制解释了当事人为什么想不出来,也就同时解释了外人为什么讲不通——甚至更糟:外部质疑会触发认知失调,人会为自己的选择生成更多辩护,从而更牢固。

04

靠什么才能出来

前三节的结论是:粘性由强化程式建立,而不受认知控制。那么解除它的机制,也只能是强化程式层面的——消退。

有效的是消退,不是切断

消退的定义是:反应不再被跟进。不是阻止反应发生,是让反应不再产生结果。

这个区别决定了操作方式。切断是高心力动作,且常在情绪峰值被推动执行,做出来的往往不是退出,是发泄或索取回应。不喂养是低心力的持续状态,每执行一次,强化就少一次。

动作对应机制
不再等回应(不是断联,是不等)第一重:不等的时候,那条回路就没被喂
不接新题目第三重:切断解题回路
不助推、也不对抗(念头起了不给续集,但也不用力赶走)对抗是另一种喂养
"不接新题目"的判据

如果一个"待解的问题",解出来之后不改变你的任何行动,那它不是问题,是钩子。

例:他是不是认真的、她会不会回头、这个框架能不能变——无论答案是什么,行动都一样。

消退曲线的形状

消退不是一条单调下降的线。它有确定的形状,而这个形状里有两个位置会让人误判。

FIG. 2消退曲线:两个会让人误判的位置
强化停止 时间 → 强化期 快速下降 低位波动 稳定消退
  • 消退爆发——强化停止后,反应先升后降。这个尖峰是曲线本身的形状,不是"他终于认真了",也不是"我根本放不下"
  • 自发恢复——已经消退的反应会自行重新出现一次或多次,一次比一次弱
  • 虚线=强化停止的时刻
整条曲线唯一需要的输入,是持续的不跟进。它不需要意志力、不需要想通、不需要恨对方、不需要仪式性的了断——只需要在这两个位置上不让步。

位置一 · 消退爆发

实验事实:当强化停止时,反应通常不是立刻下降,而是先出现一个短暂的上升——频率更高、强度更大、形式更多变。鸽子在食物停止后,会先更快、更用力地按键,然后才开始减少。

在关系里,它同时发生在两侧。对方一侧:你开始不回应,对方会升级——更多消息、更大的承诺、突然的示好,或者反向的攻击。这不是"他终于认真了",这是强化被撤走后的爆发。你自己一侧:渴望在你刚开始不喂养的那几天,会不降反升。这不是"说明我放不下"。

最实用的一条推论

在爆发点让步,等于用一个更极端的行为,去接受一次可变比率强化。

结果不是回到原点,是粘性变得更强——因为系统学到的是"闹得更大就有用"。这解释了为什么很多关系在"分了又和"之后,比之前更难分:每一次在爆发点的复合,都是一次高强度强化。

位置二 · 自发恢复

实验事实:一个已经消退的反应,在一段休息之后,可能自行重新出现,强度低于原来但确实存在。

在关系里的表现:几个月甚至几年后,一次突如其来的强烈想念、一个梦、一次冲动想联系。

自发恢复不代表消退失败,也不代表"我根本没放下"。它是曲线的正常部分。

而这一次,同样的规则适用:不喂养,它会再次下降,而且比上一次快。

如果第四重在场,单靠不喂养不够

消退作用于奖赏回路。而身份不是奖赏回路——它的供给来自你自己,不来自对方。所以"不再等回应"对它无效:你不等了,那个"我是持续给予的人"照样成立。

这一重需要一个不同的动作:把身份从这段具体的关系里拆出来。"我是一个能稳定给予的人"这件事,不需要靠一个辜负你的人来证明。它在别处同样成立,而且成立得更好——因为在一段有回应的关系里,稳定给予会被接住,而不是被消耗。

判断在场的是哪一重

如果离开的最大阻力不是"我会想他",而是"那我成了什么人"——那么在场的是第四重,不是前三重。

05

证据成色

结论成色
强化程式/部分强化消退效应行为学最稳固的实验结论之一(Ferster & Skinner, 1957)
消退爆发经典且可重复,但并非在所有个体和情境中出现
自发恢复从 Pavlov 起反复验证,极稳固
迷信行为(随机强化诱发因果误归因)Skinner, 1948,经典实验,对解释机制仍有争议
认知失调/效力合理化社会心理学核心结论,验证充分
多巴胺奖励预测误差主流神经科学
创伤性联结(权力不对等+间歇好坏)Dutton & Painter, 1981,有影响力的理论,非实验室结论
洞察不等于行为改变临床共识
状态依赖的信息可及性有实证基础,具体边界仍在研究
渐变升级、熟悉感偏好作为入口临床与依恋研究支持,具体权重有争议
身份投入/自我概念纳入关系角色临床与社会心理学广泛描述,机制清晰,缺乏实验室量化
解题回路作为第二条上瘾通道推演,非定论

粘性不来自关系的好,来自关系的不确定。

断不掉不是因为爱得深,是因为系统收不到终止信号。

而解除它的不是想通,是持续的不跟进——并且熬过爆发那一段。

附录 · 不在主链条上

以下两节与主链条相关,但不构成其中的一环。单独列出,以免稀释链条本身。

附一

镜像推论:稳定付出为什么不可见

主链条的底层原理是:信号来自变化,不来自水平。这个原理有一个镜像推论,方向相反但同源。

稳定的给予会沉降为基线。基线在感知上不产生信号,如同恒定的气味、恒定的背景噪音会失觉——只有基线的消失才产生强烈信号。

时期感知
在场时稳定付出=背景,不可见
离开后基线消失=强信号,此时才第一次被感知

由此有三条推论。其一,对方回头往往不是"后来才想明白",而是感知系统直到失去才第一次收到信号。其二,这解释了稳定型的人为什么"拉不动"处在拉扯关系里的人——在场时你的存在本身不产生可感知信号,你说的话在和一台正在运转的老虎机竞争注意力,而你是背景音。其三,这不是人性凉薄,是感知系统的构造:稳定付出的价值信号,天生延迟发送。

关于对策的一个警告

由此得出"该学会忽冷忽热"是错的——那是把弱信号换成上瘾策略,留住的人会呈现焦虑型粘着。

正确的结构是:稳定的底不能动(它提供信任和安全),可变的峰用来提供信号。底稳,峰才有意义。这不是制造不确定,是让已经在给的东西变得可被感知。

附二

退出期的操作陷阱

不是从粘性机制推出的,是执行层的观察。

在高压期做隔离

高压期强行隔离等于加压,导致焦躁和反弹。顺序应是:让能量先有出口 → 撤开、不续燃 → 进入低压期 → 此时才做隔离。

把"想被看见"伪装成"划清界限"

判据:如果你期待对方来问一嘴,那这个动作不是退出,是信号。

真的退出是安静的。放下和推开是两件事:放下是安静的,推开是用力的,而用力恰恰说明还没放下。

自我否定推着你行动

"我怎么又这样"产生的羞耻,会推人去做一个决绝的动作来了结它。而自责驱动的决定,没有一个是好的。

一个通用过滤器

抗体常在,应激会退。凡是"必须今天做"的,基本是应激推的;凡是明天、下周还成立的,才是判断给的。

好处是不需要判断动机纯不纯(难判,且容易变成自我审判),只需要问一句:这个明天还想做吗。