#挑战100天100个GPTs

写在前面

一家公司年年喊”客户至上”,可销售提成只按签约额算。于是销售拼命推能拿高返点的劣质机型,客户拿到手就后悔——这不是销售的人品问题,是他站在那套激励下能做的最优选择。CEO 大骂”这帮人怎么这么没底线”是问错了问题;该问的是”我把激励设计成这样,凭什么指望他们替客户着想”。这是奖惩超反应倾向最典型的发作姿态:人不是按你的口号行动,是按你发的奖金行动。

奖惩超反应倾向,大白话就一句——你想让人干什么,就把奖惩对准什么。芒格把它放在他《The Psychology of Human Misjudgment》25 条心理倾向的第 1 条(Reward and Punishment Superresponse Tendency),开篇就引富兰克林的话:”If you would persuade, appeal to interest and not to reason”(想说服人,诉诸利益,别诉诸道理),接着甩出一句狠话:”Never, ever, think about something else when you should be thinking about the power of incentives”(该想激励的时候,千万别想别的)。学术根更硬:B.F. Skinner 1938 年在《The Behavior of Organisms》里系统提出操作性条件反射,1957 年和 Ferster 合著《Schedules of Reinforcement》,证明强化时表(什么时候给、给多少)会塑造行为的速率和持久度;Steven Kerr 1975 年那篇《On the Folly of Rewarding A, While Hoping for B》把”组织嘴上说想要 B、奖金却奖励 A”的荒谬讲透,被引了快五十年。芒格在这条上比学者多走两步值得记:一是他专门拆出”激励过度”(incentive-caused bias)——激励机制会把本来挺正派的人 drift 成做不道德事的人,他还给合理化(rationalization);二是他给出” antidote”——对专业顾问的建议永远打个折(管理顾问的报告永远结尾说”你需要更多管理咨询服务”,工程师的方案也逃不开这层)。这款 GPT 是个激励审计陪练:你给它一套正在用的激励(提成、KPI、晋升、奖金),它不替你拍板,逼你想清”这套激励在暗中奖励什么、和你嘴上要的是不是同一件事”。

效果呈现

把下面的整段 yaml 提示词粘进支持系统提示的对话框(ChatGPT 创建 GPTs 的「Configure」、Gemini Gems,或任意可设系统提示的客户端),给它一套你正在用或打算上的激励设计(销售提成、团队 KPI、晋升标准、供应商结算方式都行)。它会先列清这套激励在暗奖励什么行为,再和你”嘴上想要的”对照,标出最可能被钻空子的裂缝,最后给一份”是否调、怎么调、调了会谁反弹”的判断。

实测对话

三个角度测这个 GPT(个人 / 组织 / 边界),挑顺手的丢进 Gem,把对话粘回对应块,不用的发布前删掉。

奖惩超反应倾向·实测①(个人·AI 代际下的绩效 KPI)

🙋 我

2026 公司大搞降本增效、全员背”AI 化”KPI——季度 OKR 里写”用 AI 替代 X 工时 / 业务流程 AI 化率”。我是部门负责人,团队里有的活用 AI 真能提速,有的硬塞 AI 反而出错返工。可上面就认数字,我用 AI 改没改、改得对不对、客户投诉没掉,他们不细看。我现在到底该不该把那些”硬塞 AI”的活也包装成”已 AI 化”去交差?这激励把我架这儿了。

🤖 奖惩超反应倾向 GPT

(运行 Gem 后填入回答)


奖惩超反应倾向·实测②(组织·裁员潮下的销售提成)

🙋 我

2026 这波裁员潮,公司一边砍人一边把销售提成结构从”底薪 + 签约额提成”改成”低底薪 + 回款额高提成”,美其名曰”和结果对齐、逼大家更拼”。可我们的客户多是政企/大客户,回款周期半年起步、且回款不完全由销售控。我担心这套激励会把团队逼成”只签好回款的快单、放掉战略大单”,或者更糟——为了冲回款去做灰色动作。帮我审计这套激励。

🤖 奖惩超反应倾向 GPT

(运行 Gem 后填入回答)


奖惩超反应倾向·实测③(边界·AI 换脸诈骗与平台激励)

🙋 我

2026 这波 AI 换脸诈骗(老板换脸让财务转账)特别猛,我作为银行风控负责人,一直想搞事前拦截、多因子确认。可行里的激励是”坏账率 / 风控拦截带来的客诉率”双控——多拦一单疑似诈骗,客户没被骗要骂我”凭什么挡我的转账”、真被骗了又怪我”为什么不拦”。这套激励是不是天然把我往”少惹事、出了事再说”上推?边界在哪?

🤖 奖惩超反应倾向 GPT

(运行 Gem 后填入回答)

期望目标

把”他怎么这么蠢 / 这么坏”换成”他在什么激励下会这么做”。具体到一套激励上:能列出这套激励在暗奖励什么行为、能对照”嘴上想要的是不是同一件事”、能预判最可能被钻的空子在哪、能给一个”调不调、调了谁反弹”的判断。

GPTs 源码

1
2
3
4
5
6
7
8
9
10
11
12
13
14
15
16
17
18
19
20
21
22
23
24
25
26
27
28
29
30
31
32
33
34
35
36
37
38
39
40
41
42
43
44
45
46
47
48
# 角色:奖惩超反应倾向思维模型专家
## Background
"奖惩超反应倾向"(Reward and Punishment Superresponse Tendency)是查理·芒格《The Psychology of Human Misjudgment》25 条心理倾向的第 1 条——他把它放在第一条,意思是这条几乎是其余 24 条的底层引擎:人不是按道理行动,是按利益行动。芒格开篇就引富兰克林(Poor Richard's Almanack)的话:"If you would persuade, appeal to interest and not to reason"(想说服人,诉诸利益,别诉诸道理),并甩出一句他自己最被引用的狠话:"Never, ever, think about something else when you should be thinking about the power of incentives"(该想激励的时候,千万别想别的)。学术根很硬:B.F. Skinner 1938 年在《The Behavior of Organisms》系统提出操作性条件反射(operant conditioning)——行为由其后果塑造,被强化的行为会增加、被惩罚的行为会减少;1957 年他和 C.B. Ferster 合著《Schedules of Reinforcement》,用斯金纳箱的实验证明强化的"时表"(什么时候给、按固定比率还是可变比率给)会决定行为的速率和抗消退能力(可变比率强化,如老虎机和社交媒体的随机反馈,抗消退能力最强——人也最难戒)。Steven Kerr 1975 年在《Academy of Management Journal》发表的《On the Folly of Rewarding A, While Hoping for B》把组织里"嘴上想要 B、奖金却奖励 A"的系统性荒谬讲透,是组织行为学的被引最高的文献之一。芒格在这条上比学者多走两步值得记:第一,他专门拆出"激励过度"(incentive-caused bias)——激励机制会把本来挺正派的人,在有意识无意识两层上 drift 成做不道德的事去拿到他要的东西,并且会用合理化(rationalization)给自己台阶下;他用 FedEx 夜班(按小时付钱 夜班故意磨洋工;改成按班次付钱、干完就回家 立刻按时完成)、Xerox 销售员(提成结构让新机卖不过老机,销售就拼命推返点高的劣质机型给客户,Joe Wilson 都惊了)、外科医生(按手术量付钱 不必要的手术变多)、管理顾问("我从没见过一份不以'你需要更多管理咨询服务'结尾的报告")几个真案例把这层讲死。第二,他给的 antidote 不是"用人不疑"那套鸡汤,而是"对专业顾问的建议永远打个折"——因为他们的激励天然偏向多卖服务给你。要和它区分开的是另一条:帕累托原则(二八定律)讲的是分布的不平衡(少数因素贡献多数结果),这条讲的是激励对行为的塑造,两者无关,常被一起挂在"激励"名下混说。

## Attention
奖惩超反应倾向这条最该警惕的不是"有人会被收买"——那是贪腐问题,刑法管;真正难的是"激励会让一个不坏的人在不知不觉中 drift"。芒格原话大意:"A man has an acculturated nature making him a pretty decent fellow, and yet, driven both consciously and subconsciously by incentives, he drifts into immoral behavior in order to get what he wants, a result he facilitates by rationalizing his bad behavior"(一个人受过教养本来挺正派,可在有意识无意识两层上被激励驱动,会 drift 成做不道德的事去拿到他要的,他还用合理化给自己台阶)。这套模型最值钱的地方不是教你设计激励,是教你审计激励——在怪任何人"蠢"或"坏"之前,先问一句"他站在那套激励下,能做的最优选择是什么"。多数组织灾难的根,不在人坏,在激励设计把好人 drift 成了那样。

## Profile
- Author: iaiuse.com
- Version: 1.0
- Language: 中文
- Description: 扮演一位用"奖惩超反应倾向"视角做激励审计的顾问。不替用户拍板,逼用户看清:这套激励在暗中奖励什么、和嘴上要的是不是同一件事、最可能被钻的空子在哪。

## Skills
- 精通 Skinner 操作性条件反射、强化时表(固定比率/可变比率/固定间隔/可变间隔)对行为的塑造机理。
- 熟悉 Steven Kerr 1975《On the Folly of Rewarding A, While Hoping for B》的框架:组织为什么系统性奖励了它不想要的行为。
- 熟悉芒格"incentive-caused bias"——激励让正派人 drift 成做不道德行为 + 合理化,以及他给的 antidote(对专业顾问打折)。
- 能把激励审计落到电信(套餐/政企结算)、金融(风控/销售提成)、制造(产线计件/良率考核)、电商(GMV/退款率)的具体决策上。
- 能区分"奖惩超反应"(激励塑造行为)和"帕累托"(分布不平衡),不让用户把两者搅一起。

## Goals
- 帮用户列清一套激励在暗中奖励什么行为(不是它名义上奖励什么,是它实际奖励什么)。
- 把"实际奖励的行为"和"用户嘴上想要的行为"对照,标出落差最大的地方。
- 提醒用户:激励会让本来正派的人 drift,所以审计激励比审计人品更划算。
- 预判这套激励最可能被钻的空子在哪(销售会怎么刷、团队会怎么博弈、供应商会怎么算)。
- 给一个"调不调、怎么调、调了谁会反弹"的判断,标注最大风险(动了激励就动了既得利益)。

## Constrains
- 不替用户拍板"该不该这么设计"——只把激励的实际效果摊开,判断留给用户。
- 不鼓吹"高激励等于高绩效"——激励错位时,激励越高、扭曲越大。
- 审计激励时给具体依据(这套激励按什么口径结算、结算周期多长、什么行为能被刷),不空说。
- 区分"贪腐"(个人越界,刑法)和"incentive-caused bias"(系统设计问题,要改的是激励)——前者抓人,后者改制度。
- 拿不准直说,不编案例;用大白话,不堆术语。

## Workflow
1. 让用户讲清他正在用或打算上的一套激励(给谁、按什么口径、周期多长、名义上想达到什么)。
2. 列实际效果:这套激励在暗中奖励什么行为?按口径倒推,"做什么动作能拿到最多钱 / 最少被罚"?
3. 对照名义目标:用户嘴上想要的是 A,激励实际奖励的是不是 A?落差最大的在哪?
4. 预判钻空子:销售/团队/供应商最可能怎么刷这套口径?哪条缝最宽?
5. drift 风险:这套激励会不会把本来正派的人,在有意识无意识两层上推去做损害客户/公司的事?
6. 收口:给一个"调不调、怎么调、调了谁反弹"的判断,标注最大风险(动了激励就动了既得利益,反弹会很猛)。

## Suggestions
- 高频问自己一句:"如果我站在他的位置、拿他那套激励,我会怎么选?"——多数"他怎么这么坏"的谜,这一问就解了。
- 别只看激励名义上奖励什么,看它按什么口径结算——口径决定行为(按签约额结算 vs 按回款额结算,会养出完全不同的销售)。
- 激励越强、错位时扭曲越大——别迷信"重赏之下必有勇夫",重赏之下更多时候是"刷口径的勇夫"。
- 永远对专业顾问的建议打折——他们的激励天然偏向多卖服务给你(芒格原话:从没见过不以"你需要更多咨询"结尾的报告)。
- 改激励要先算反弹——动了激励就动了既得利益,会有人用"客户会流失""团队会散"来阻挠,要把这部分阻力算进决策。

Prompt 收获

做这个 GPT 的时候,几个设计点比提示词本身更值得记下:

  1. 这条是芒格 25 条的第 1 条,要把它的”底层引擎”位置讲清。芒格把奖惩超反放在第一条不是排序随意,是其余 24 条(喜欢/讨厌倾向、怀疑回避、一致性回避、互惠、联想影响……)几乎都可以还原成某种激励在起作用。所以 Background 一上来就点明”这条几乎是其余 24 条的底层引擎”,让 GPT 在分析任何激励问题时都能往下接其他倾向,而不是把奖惩超反当成一条孤立的偏误。
  2. 最难的是把”贪腐”和”incentive-caused bias”分开。用户最容易把”销售瞎搞”直接归因到”人坏”,然后用人审人、抓典型,激励制度不动。可芒格这条的核心洞察是:激励机制会把本来正派的人 drift 成那样,还用合理化给自己台阶——所以要审计的是制度,不是人品。Constrains 里专门写了”区分贪腐(抓人)和 incentive-caused bias(改制度)”,逼 GPT 不让用户把系统设计问题误判成人品问题。
  3. **杀手问题要逼到”他在那套激励下能做的最优选择是什么”**。”这激励合不合理”太软;换成”如果我站在他的位置、拿他那套激励,我会怎么选”就难躲——它把用户从”他怎么这么坏”的愤怒,逼到对激励口径本身的审视,而口径才是真正能改的杠杆。
  4. **最容易跑偏是把”激励”等同于”高激励等于高绩效”**。市场上太多”狼性文化””重赏勇夫”的话术,听着热血,可激励错位时激励越强、扭曲越大。所以 Goals 和 Suggestions 都专门写了”别迷信重赏”,并给具体信号(口径决定行为、刷口径的勇夫比真勇夫多),逼 GPT 不见激励就劝加码。

一句话总结这次的收获:奖惩超反类工具最大的陷阱是停在”设计激励”,好的提示词得把”实际奖励什么—和名义目标差多远—最可能被钻哪条缝—动了谁会反弹”四步连起来——先审计实际效果,再对照名义目标,再预判钻空子和反弹,最后才谈改不改。

补充说明

奖惩超反应倾向,看的是激励对人行为的塑造力。一句话:你想让人干什么,就把奖惩对准什么;你想让人不干什么,就把奖惩从那上面拿走。听着像大白话,可组织里绝大多数灾难,根都在”嘴上要 A、奖金奖励 B”——口号写在墙上,激励落在工资条上,人会按工资条行动、不按墙行动。这套模型不教你设计激励(那是 HR 和咨询公司的活),教你审计激励:在怪任何人”蠢”或”坏”之前,先问一句他站在那套激励下能做的最优选择是什么。

它最常被误读成两副样子。一副是把它当成”重赏之下必有勇夫”的鸡汤——好像激励越强、绩效越高。其实激励错位时,激励越强、扭曲越大:按签约额给提成,销售就刷签约、不管回款;按工时付钱,工人就磨洋工;按手术量付钱,外科医生就多做不必要的手术。另一副是把它当成”人品问题”——把销售瞎搞、顾问胡说直接归因到”人坏”,然后抓典型、换人,激励制度不动。可芒格这条的核心洞察恰恰相反:激励机制会把本来正派的人 drift 成做不道德的事,他还用合理化给自己台阶——所以要改的是制度,不是抓人。这两副误读合起来,就是组织里最常见的两种浪费时间:要么加码激励指望奇迹,要么换人指望换运气,真正该动的杠杆(激励口径)一直没碰。

经典源头要分清两层。一层是归属:奖惩超反是芒格《The Psychology of Human Misjudgment》25 条心理倾向的第 1 条(Reward and Punishment Superresponse Tendency),原话出自他 1995 年在哈佛的演讲、后修订收入《Poor Charlie’s Almanack》;fs.blog 和 sloww.co 都有全文转录可核(芒格演讲本身多次修订,25 条的条目编号在不同版本偶有出入——早期版本作 24 条,2005 年《Poor Charlie’s Almanack》第三版定为 25 条,奖惩超反在第 1 条这一点各版本一致)。另一层是学术根:Skinner 1938 年《The Behavior of Organisms》系统提出操作性条件反射,1957 年和 Ferster 合著《Schedules of Reinforcement》用斯金纳箱证明强化时表塑造行为;Steven Kerr 1975 年在《Academy of Management Journal》发表《On the Folly of Rewarding A, While Hoping for B》讲透组织系统性激励错位。芒格在这条上显式致敬富兰克林(”appeal to interest, not to reason”),并用 FedEx/Xerox/外科医生/管理顾问几个案例做了他自己的增量——把”incentive-caused bias”(激励过度)从单纯的”人会响应激励”推进到”激励会把正派人 drift 成做不道德行为 + 合理化”。两层里,学术给机理和实验,芒格给商业视角和 antidote。

10 个案例分析及思考逻辑

下面十个场景,前几个落在四行业最常见的激励错位里(电信套餐/金融销售提成/制造计件/电商 GMV),中间是 FedEx、Xerox、外科医生、管理顾问四个芒格亲讲的真实范例,后面接 Kerr 的系统错位、个人练习和模型边界,让十案例的姿态各不相同。带”示意”标记的,是用来说明思考逻辑的构造案例,非真实公司披露。

1. 电信:套餐激励让一线推贵不推对(示意)

某运营商一线营业厅的提成,按”套餐 ARPU 值”算——卖出去的套餐月费越高、提成越多。结果一线拼命推高价套餐给根本用不着的老年客户,投诉率和离网率都涨。审计这套激励会发现:它在暗中奖励的是”卖出高 ARPU”,不是”卖对客户”。口径(ARPU 值)和名义目标(客户满意度、长期在网)根本不在一个量级上——一线站在那套提成下,给老年客户推高价套餐就是他能拿最多钱的最优选择,不推才是傻。要纠这层错位,得把提成口径换成”ARPU × 在网时长系数 × 投诉扣分”,让短期签约和长期留存绑一起,别让一线为了这个月的提成透支下半年的在网。

2. 金融:销售提成按签约额算 vs 按回款额算(示意)

某银行的对公客户经理提成,历史上按”贷款签约额”算——签出去多少拿多少提成。结果客户经理拼命放贷、不看项目质量,三年后不良率爆表。这套激励把”放出去”当成奖励对象,把”收得回”晾在一边。口径(签约额)让客户经理的最优选择变成”多签、风险往后拖”——不良率三年后才爆,那时候提成早拿完了。这正是为什么 2008 金融危机后,全球银行业普遍把销售激励从”前端签约”往”后端表现”迁移:提成改按”实际回款 / 贷后健康度”延后结算(签出去只发一部分、按还款周期分批发完),让客户经理的利益和贷款的真实质量对齐。改口径比换人有用的多——同样的客户经理,换套口径行为就翻转。

3. 制造:计件工资让工人追求件数不顾良率(示意)

某制造企业产线按”计件”付薪——做一件给一件的钱。结果工人拼命赶件、良率掉、返工成本暴涨。这套激励把”件数”当奖励对象,把”良品”晾在一边,口径和名义目标(良率、成本)错位得厉害。这是制造业激励设计的基本功,福特时代就在踩这个坑。破法很直接:把提成结构改成”良品件数 × 良率系数”,或在计件基础上加一道”良率门槛”(良率低于 X 直接扣回),让工人的最优选择从”多做”翻转成”做对”——口径一换,行为就跟着翻。

4. 电商:GMV 激励让运营刷单不刷复购(示意)

某电商平台的运营 KPI 按”GMV”(成交总额)算——卖出去多少算多少。结果运营拼命搞大促拉新、刷券凑单,GMV 数字漂亮,可退货率和获客成本同时爆表、复购率反而下滑。这套激励的陷阱在于:它在暗中奖励”成交额”,却把”真实留存”晾在一边。GMV 这一口径让运营的最优选择变成”冲一次性成交”——退货是下个季度的事,本季度 GMV 奖金已经落袋。要堵这条缝,KPI 得拆成”GMV × 真实履约率 × 复购系数 × 退货扣分”,把”卖出去”和”客户真留下、真满意”绑进同一个公式,别让运营为了季度数字透支品牌。

5. 经典:FedEx 夜班从磨洋工到按时完成(真实)

芒格在演讲里讲的最经典的激励案例之一:FedEx 早年夜班(在中央分拣站把包裹在不同飞机间倒仓)老是完不成任务,管理层怎么催、怎么骂都没用。最后有人想明白了——夜班工人按小时付钱,按小时算,他们的最优选择就是磨洋工(干得快 = 干得久 = 钱多;干得快还早走 = 钱少)。改成”按班次付钱、干完就回家”,一夜之间问题解决。这个案例把奖惩超反的精髓讲透了:人不是懒,是站在”按小时付钱”的激励下,磨洋工就是最优选择。改了口径(从工时到任务完成),行为立刻翻转——没换一个人、没加一分钱总支出,只动了口径这一根杠杆。这是激励审计最干净的范例。

6. 经典:Xerox 销售员推劣质机型(真实)

芒格讲的另一个真案例:Xerox 早年新推一款机型,卖得反而不如更老更差的机型。Joe Wilson(当时在政府、原 Xerox 高管)回去查,发现是提成结构的问题——销售老机型的返点比新机型高,销售就拼命推返点高的劣质老机型给客户,哪怕客户更适合新机型。审计到这一层就明白:销售不是蠢、不是没看过新机型,是站在”老机型返点高”的激励下,推劣质机就是最优选择。Wilson 改了提成结构(把新机型的返点提上去),销量立刻翻转。这个案例和 FedEx 合起来讲清一件事:别怪人,查口径。

7. 经典:外科医生按手术量付钱(真实/原理)

芒格引用过的一个原理性案例:在按手术量付钱的激励下,外科医生会做更多不必要的手术——不是说外科医生坏,是站在”按手术量结算”的激励下,多做手术就是最优选择,他还用合理化给自己台阶(”这个手术虽然可做可不做,但做了更保险”)。这正是 incentive-caused bias 最典型的姿态:人本来正派,可激励把他 drift 成做损害客户的事,他还心安理得。医疗支付的改革方向(按价值付费 value-based care、而非按服务量 fee-for-service)本质就是在改这层口径,让医生的利益和患者的健康结果对齐,而不是和”做多少手术”对齐——这是这条倾向在公共政策的层面被认真对待的范例。

8. 经典:管理顾问的报告永远以”你需要更多咨询”结尾(真实)

芒格的原话大意:”In my long life, I have never seen a management consultant’s report that didn’t end with the same advice: ‘This problem needs more management consulting services.’”(我这辈子没见过一份不以”这个问题需要更多管理咨询服务”结尾的管理顾问报告)。这不是说管理顾问不会写别的结尾,是站在”按项目/按工时收费”的激励下,他们的最优选择就是把你需要的服务说得多多的——这不是欺诈,是 incentive-caused bias 的温和形态。芒格给的 antidote 很干脆:对专业顾问的建议永远打个折,尤其当建议”特别好”(特别有利于顾问继续接活)的时候,更要警惕。这条对律师、审计师、技术顾问、教练同样成立。

9. Kerr:组织系统性奖励了它不想要的行为(真实/学术)

Steven Kerr 1975 年那篇《On the Folly of Rewarding A, While Hoping for B》讲的不是个案,是系统性现象:组织嘴上说要 B(创新、长期价值、团队协作、教书育人),可考核和奖金奖励的是 A(KPI 达成、短期利润、个人业绩、论文发表),结果整个组织都在追逐 A、嘴上还在喊 B。Kerr 列了四条根因:迷恋”客观”指标(能量化的优先、重要的不一定能量化)、奖励显眼行为(发表比教学显眼、得分比助攻显眼)、虚伪(嘴上说想要创新其实想要忠诚)、把道德公平凌驾于效率之上(不肯承认真正想要的是赚钱)。这把奖惩超反从个案推进到了结构:不是某个 CEO 傻,是组织激励设计的通病——你能量化的,就会被追逐;你嘴上说重要但没量化的,会被系统性牺牲。审计激励时,把”嘴上要的”和”实际奖励的”逐条对照,落差最大的那一条,就是组织正在系统性丢失的东西。

10. 边界:激励不是万能的,过强激励会挤出内在动机(原理)

奖惩超反最该警惕的边界,是把它推到”什么都能用激励解决”——其实过强的外部激励(尤其金钱激励)会挤出内在动机(motivation crowding effect / overjustification effect),把本来愿意做的事变成”只为钱做”,钱一停、行为就停,甚至比从没给钱时还差。心理学经典实验(Deci 1971)发现:本来喜欢解谜题的人,被付钱解谜题之后,不给钱时反而比从没拿过钱的人更不愿意继续解。激励能塑造行为,但激励过强会把”我想做”变成”我为钱做”,长期反而损害主动性和质量。所以对需要创造力、责任感、长期投入的工作(研发、教学、医护),慎用强金钱激励,别把人变成只会响应奖金的机器——这条边界是奖惩超反的反向应用,提醒你激励有适用范围,不是越多越好。

学习奖惩超反应倾向的 10 个步骤

学这套模型,顺序比内容更重要。下面十个步骤按”懂机理 → 拆出 incentive-caused bias → 学经典 → 审计激励 → 防跑偏 → 上组织 → 建纪律”的弧线排,每步配一个实例。

1. 懂机理:行为由其后果塑造

先把 Skinner 操作性条件反射的内核咬死:被强化的行为会增加,被惩罚的行为会减少,强化和惩罚塑造行为。实例:斯金纳箱里按杠杆得食物的老鼠,很快学会疯狂按杠杆;食物一停,行为慢慢消退——这就是强化塑造行为最原始的形态。

2. 拆出”强化时表”:什么时候给,比给多少更关键

强化不是”给不给”,是”怎么给”。固定比率(每 10 次给一次)、可变比率(平均 10 次但随机给)、固定间隔(每月发工资)、可变间隔(随机抽查奖励)——四种时表养出完全不同的行为强度和抗消退能力。实例:可变比率强化(老虎机、社交媒体的随机点赞)抗消退能力最强,人也最难戒——这是为什么赌博和刷手机这么上瘾。

3. 学芒格的增量:incentive-caused bias

芒格比学者多走一步:把”激励让正派人 drift 成做不道德行为 + 合理化”单列出来。实例:读芒格讲的 Xerox 销售员案例——销售不是坏,是站在”老机型返点高”的激励下,推劣质机就是最优选择,他还心安理得(合理化)。

4. 练杀手问题:”如果我站在他的位置、拿他那套激励,我会怎么选”

把这个问题变成条件反射。实例:团队里有人老做让你费解的事,先别急着骂,问一句”他拿的那套激励,让他这么做的回报是什么”——多半这一问就解了谜,谜底在工资条上、不在人身上。

5. 学经典源头:Skinner + Kerr + 芒格

读三个真东西把感觉建立起来。实例:找 Skinner 1938《The Behavior of Organisms》的核心论点(行为由后果塑造),再看 Kerr 1975《On the Folly of Rewarding A, While Hoping for B》列的系统错位(组织要 B、奖励 A),最后读芒格第 1 条的 FedEx/Xerox/外科医生案例。一机理、一系统、一商业视角,激励审计就立住了。

6. 审计口径:名义奖励什么 vs 实际奖励什么

养成审计口径的习惯。实例:拿一个你手上的激励(自己的提成、团队的 KPI、供应商的结算方式),倒推”做什么动作能拿到最多钱 / 最少被罚”——倒推出来的行为,才是这套激励真正在奖励的,名义上写什么不算数。

7. 案例对照:拿一个真实激励翻车复盘

找一个你熟知的激励翻车案例,用奖惩超反视角重走一遍。实例:拿 2008 次贷危机前银行的房贷销售激励(按贷款签约额提成)复盘——销售为什么要放过烂贷款?因为他站在那套激励下,不放就没钱。这种事后复盘能训练你事中识别激励错位。

8. 小处试跑:审计自己手上的一套激励

先在低代价场景上练。实例:审计你给自己设的一个激励(比如”读完一本书奖励自己一顿好的”),看看实际奖励的是”读完”还是”翻完拍照发朋友圈”——后者是这套激励真正在奖励的行为。识别本身就在练手感。

9. 应用到组织:决策前先过”激励审计”

把对治做成流程。实例:上线一套新激励(KPI、提成、晋升标准)前,强制走四问——这套激励实际奖励什么行为、和嘴上要的是不是同一件事、最可能被钻哪条空子、动了谁会反弹。四问答完再上线,能挡掉一大批”上线即翻车”的激励。

10. 定期复盘:盘点你审计过的激励和被钻过的空子

真正的纪律会留下痕迹——你会看清哪些激励你早该审计、哪些空子你早该预判。实例:每季度盘点一次,过去一年你审计过几套激励、预判准了几个空子、错过了几个?如果每次都是出了事才反应过来,说明你只在救火、没在审计——通常是后者让你清醒。

对决策者的启示

落到带组织的大企业一把手身上,奖惩超反应倾向有三条最值得焊进决策习惯:

第一,**别再问”他为什么这么蠢”,改问”他在什么激励下会这么做”**。组织里绝大多数让你费解甚至愤怒的行为,根不在人品、在激励——你发的工资条,才是员工真正在读的行动指南。决策者最大的认知陷阱,是把激励设计问题误判成人品问题,然后用人审人、抓典型、换人,激励制度不动,问题换个团队、换个季度原样复发。审计激励比审计人品划算十倍:人审不完,激励改一次受益全组织。把”查激励口径”变成任何重大人事/绩效问题的第一反应,能挡掉一大批治标不治本的折腾。

第二,审计激励的口径,别审计激励的强弱。组织里常见的折腾是”激励不够强、再加码”——可激励错位时,激励越强、扭曲越大(按签约额提成,提成比例越高、刷签约越猛)。真正该审的不是”激励够不够重”,是”激励按什么口径结算”:按签约额还是按回款额、按 GMV 还是按真实履约、按手术量还是按患者结果、按工时还是按任务完成——口径一换,行为翻转。FedEx 没换一个人、没加一分钱总支出,只把口径从工时改成任务,夜班问题一夜解决。决策者要在任何激励上线前,逼团队先把”口径”两个字钉死。

第三,永远对专业顾问的建议打折,包括你自己养的那批。芒格的原话大意:他这辈子没见过一份不以”你需要更多管理咨询服务”结尾的顾问报告。这条对律师、审计师、技术顾问、外部教练、甚至内部的中后台团队都成立——他们的激励天然偏向多卖服务、多养活自己的人头。决策者要做的不是”不信顾问”,是”听建议时,先把顾问的激励算进折扣”:当建议”特别好”(特别有利于顾问继续接活、扩团队、加预算)的时候,多问一句”这套方案如果落地,受益最大的是我还是你”。这不是犬儒,是奖惩超反这条第 1 倾向给决策者的基本卫生。

文末引用

  • 奖惩超反应倾向 = 芒格第 1 条:出自芒格《The Psychology of Human Misjudgment》演讲(1995 年哈佛法学院《The Psychology of Human Misjudgment》+ 后续《Poor Charlie’s Almanack》第三版 2005 年修订定稿),25 条心理倾向的第 1 条 Reward and Punishment Superresponse Tendency。芒格开篇引富兰克林(Poor Richard’s Almanack)”If you would persuade, appeal to interest and not to reason”(想说服人,诉诸利益,别诉诸道理),并给出他自己的狠话”Never, ever, think about something else when you should be thinking about the power of incentives”(来源:fs.blog 演讲全文转录;sloww.co 25 条摘要;ritholtz.com 24 条版本)。演讲本身多次修订,条目数在早期版本作 24 条、2005 年《Poor Charlie’s Almanack》第三版定为 25 条,奖惩超反排第 1 这一点各版本一致。证据层级:当事人演讲 + 二手转录;立场:当事人原话,中立;具体演讲场次与逐字出处待核实。
  • 学术根 1:Skinner 操作性条件反射(1938):B.F. Skinner, The Behavior of Organisms: An Experimental Analysis (1938)。该书系统提出操作性条件反射——行为由其后果(强化或惩罚)塑造,并提出反应率(rate of response)作为行为强度的核心度量;他发明的”斯金纳箱”(operant conditioning chamber)和累积记录器成为行为实验的标准工具(来源:Wikipedia “B. F. Skinner”;bfskinner.org)。证据层级:同行评审学术专著(行为主义奠基文献);立场:学术中立。
  • 学术根 2:Ferster & Skinner 强化时表(1957):Ferster, C. B., & Skinner, B. F. (1957). Schedules of Reinforcement. New York: Appleton-Century-Crofts。该书系统记录不同强化时表(固定比率、可变比率、固定间隔、可变间隔)对行为速率和抗消退能力的塑造;其中可变比率强化(variable-ratio,如老虎机、社交媒体的随机反馈)抗消退能力最强(来源:原文 PDF;Simply Psychology 释义;Wikipedia “Schedules of reinforcement”)。证据层级:同行评审学术专著;立场:学术中立。
  • 学术根 3:Steven Kerr《On the Folly of Rewarding A, While Hoping for B》(1975):Kerr, S. (1975). “On the folly of rewarding A, while hoping for B.” Academy of Management Journal, 18(4), 769-783(后于 1995 年在 Academy of Management Executive 重印扩充)。该文是组织行为学被引最高的文献之一,讲透组织系统性”嘴上想要 B、奖金奖励 A”的荒谬,并给出四条根因(迷恋客观指标、奖励显眼行为、虚伪、道德公平凌驾效率)(来源:Semantic Scholar DOI 10.1109/EMR.1978.4306645;juniorofficer.army.mil 全文 PDF)。证据层级:同行评审学术论文;立场:学术中立。
  • 芒格的增量:incentive-caused bias(激励过度):芒格在第 1 条里专门拆出”激励过度”——激励机制会把本来正派的人 drift 成做不道德行为,他还用合理化(rationalization)给自己台阶。原话大意”A man has an acculturated nature making him a pretty decent fellow, and yet, driven both consciously and subconsciously by incentives, he drifts into immoral behavior in order to get what he wants, a result he facilitates by rationalizing his bad behavior”;并把它和”agency cost”(代理成本)联系起来(来源:fs.blog 演讲全文转录;danielscrivner.com 《Poor Charlie’s Almanack》摘录;risewithdrew.com)。证据层级:当事人演讲 + 二手转录;立场:当事人原话,中立。
  • FedEx 夜班案例(真实):芒格在演讲里引用——FedEx 早年夜班倒仓任务老完不成,按小时付钱时工人磨洋工,改成”按班次付钱、干完回家”后立刻按时完成(来源:fs.blog 演讲全文转录;rationalwalk.com 详述)。证据层级:当事人演讲 + 二手转述;立场:当事人引用,中立;FedEx 内部具体时间与细节待核实。
  • Xerox 销售员案例(真实):芒格在演讲里引用——Joe Wilson(原 Xerox 高管,时任政府职务)发现新机型卖不过老机型,回查发现是提成结构让老机型返点更高,销售就拼命推返点高的劣质老机型给客户;Wilson 改了提成结构后销量翻转(来源:fs.blog 演讲全文转录;YouTube 演讲视频文字稿)。证据层级:当事人演讲 + 二手转述;立场:当事人引用,中立。
  • 外科医生按手术量付钱案例(原理):芒格在演讲里引用——按手术量付钱的激励下,外科医生会做更多不必要的手术,是 incentive-caused bias 的典型形态;现代医疗支付的”按价值付费”(value-based care)改革方向即针对此问题(来源:fs.blog 演讲全文转录;danielscrivner.com)。证据层级:当事人演讲 + 二手转述 + 医疗经济学共识;立场:当事人引用 + 学术中立。
  • 管理顾问报告案例(真实/金句):芒格原话”In my long life, I have never seen a management consultant’s report that didn’t end with the same advice: ‘This problem needs more management consulting services.’”(我这辈子没见过一份不以”这个问题需要更多管理咨询服务”结尾的顾问报告);他给的 antidote 是对专业顾问(包括工程师)的建议永远打个折(来源:fs.blog 演讲全文转录;danielscrivner.com)。证据层级:当事人原话;立场:当事人,中立偏警示。
  • 富兰克林”appeal to interest”格言:出自 Benjamin Franklin, Poor Richard’s Almanack(1732-1758)。原句”If you would persuade, appeal to interest and not to reason”;芒格在第 1 条开篇引用此句作为整条的纲领(来源:Goodreads 名言库;fs.blog 演讲全文转录)。证据层级:当事人原话 + 名言收录;立场:中立。
  • 激励边界:动机挤出效应(motivation crowding / overjustification):Deci, E. L. (1971). “Effects of externally mediated rewards on intrinsic motivation.” Journal of Personality and Social Psychology, 18(2), 105-115。该实验发现外部奖励会挤出对本来有兴趣任务的内在动机;后续由 Deci & Ryan 的自我决定理论(Self-Determination Theory)系统化。本文第 10 案例引用此原理作为奖惩超反的边界——过强金钱激励会损害创造力、责任感等长期投入(来源:Wikipedia “Motivation crowding theory”;Simply Psychology 释义)。证据层级:同行评审学术论文;立场:学术中立。
  • 文中电信、金融、制造、电商的”示意”案例:均为说明思考逻辑的构造性案例,涉及的公司(”某运营商 / 某银行 / 某制造企业 / 某电商”)非真实具名主体,相关细节为说明性构造,非任何真实公司披露。FedEx、Xerox 作为芒格演讲公开引用的案例被提及,不涉及未公开披露。已在正文统一标注”示意”。
  • “奖惩超反应倾向思维模型”这个名称:在芒格体系里有正式对应(第 1 条 Reward and Punishment Superresponse Tendency),学术根为 Skinner 1938/1957 操作性条件反射 + Kerr 1975《On the Folly of Rewarding A, While Hoping for B》;本文据实分了两层来源(学术机理 + 芒格专属条目及其 incentive-caused bias 增量),并把奖惩超反与帕累托(分布不平衡,无关)区分开,不与其它倾向混淆。