考什么就得到什么——奖金为什么会毁掉绩效
委托代理与多任务模型:量什么有什么,量不到的消失
2026-10-09 · 01-金融学 · 契约与激励(机制解释文第六篇)
事实分档图例
公认 32 教科书级共识或记载明确可核 推断 4 有依据但口径/解读有分歧 存疑 1 流传广但查不到可靠出处,或两说并列三个 N 不用手填:assemble.py 拼接时实扫自动回填(各档总数减图例那一枚)。
这份页面讲什么
绩效奖金不是在给"业绩"付钱,是在给"你能看见的那部分业绩"付钱——于是代理人把努力全部搬进你能看见的地方。这不是道德问题,是机器的运转方式。
先看三张旧报纸和一份判决书。1957 年,美国《新闻周刊》报道了苏联古比雪夫(伏尔加河边)一家制钉厂的处境:上面按数量考核,厂长超额完成——全厂只产小钉;建设部门抱怨大钉短缺,指标改成按重量算,厂长立刻全部转产大钉,中号钉从来没排上日程公认。苏联讽刺杂志《鳄鱼》1954 年的漫画:起重机和一群工人费劲吊起一枚巨型钉子,厂长在旁边领功公认。
再看 2016 年的美国:富国银行被查出,员工在客户不知情的情况下开设了约 350 万个假账户——只为了凑那道"每户平均 8 个产品"的交叉销售指标。被解雇的基层员工 5,300 人,2020 年该行为此认罚 30 亿美元公认。比这更近的中国病房里:济南三甲医院康复科的患者发现,住院到 15—20 天就会被"建议"转院——因为"平均住院日"是医院的考核指标,超时科室要扣奖金公认。
三个现场隔了半个地球、六十年,剧本却是同一个:量什么,就得到什么;量不到的,消失。没人想使坏。厂长想要奖金,柜员想要保住工作,医生想要科室不被扣钱——每一步都理性,合起来是荒诞。为什么"发奖金"这件天经地义的事,会系统性地把组织带歪?这套机制有没有解?
这套问题的标准答案来自 2016 年诺贝尔经济学奖:本特·霍尔姆斯特伦(Bengt Holmström)与奥利弗·哈特(Oliver Hart)的契约理论。本页拆的是霍尔姆斯特伦这一半——委托-代理模型与多任务模型。读完你带走一台发动机:以后看到任何 KPI、任何绩效方案、任何"重奖之下必有勇夫",都能照一照,先问一句:量不到的那一半,谁干?
不写什么(口径声明)
同届诺奖的另一半——哈特的不完全契约理论(合约写不尽所有情形时,剩余控制权该给谁)——不展开,那是"合约写不长"的问题,本页拆的是"合约能写的那部分怎么写歪"。CEO 股权激励只作旁注,不展开薪酬设计。另有一个更老的亲戚——签约之前看不清对方底细的"逆向选择",在《柠檬市场——劣币驱逐良币的完整工艺》里已拆完;本页全是签约之后的事:看不清努力,经济学叫道德风险。两页合起来,才是"信息不对称"的完整地图。
三个现场:同一台戏,三种道具
把三个现场放在一起读,才能看清这不是哪国、哪种制度独有的病。三个案例各抽一层,机器的三个零件就露出来了。
| 现场 | 量的指标 | 没量的东西 | 理性反应 |
|---|---|---|---|
| 苏联制钉厂(1957) | 钉子数量 → 改重量 | 钉子到底合不合用 | 全产小钉 → 全产大钉 |
| 富国银行(2016 曝光) | 人均产品数(交叉销售率) | 客户要不要、是真是假 | 350 万个假账户 |
| 济南三甲康复科(2021—) | 平均住院日、DRG 单病种费用 | 病人好没好 | 没好也"被出院",转两家医院来回住 |
注意第三列:消失的从来不是"努力",是没被测量的那部分任务。钉厂不是停产了,是只产能得分的钉;柜员不是不工作了,是只开能计数的账户;医生不是撵人,是把结算拆成两次住院。中国医保部门已经给"分解住院""推诿危重病人""提供医疗服务不足或提前出院"下了正式定义,写进 DRG 付费的违规认定文件公认——监管语言里出现这些词,本身就说明"变形"有多成规模。
苏联的例子还有个更扎心的后传。计划部门不是没发现指标变形——他们改了好几轮:总产值指标被发现"算进原材料转移价值、只管入库不管卖掉",改销售额;销售额还是不反映真实效益,再改定额净产值——一个纯计算指标公认(1965、1979 两轮改革)。每换一次,工厂照样找得到新的空子。这不是苏联人笨,是指标与真实目的之间的缝隙永远存在,而奖金(和惩罚)只会流进缝隙里。
顺带校准一个流传更广的版本:网上常说苏联按重量验收玻璃灯具,造出"重得压塌天花板"的吊灯。按重量考核确实在苏联工业里普遍存在(金属轧材、化工设备都有类似记载公认),但"吊灯压塌天花板"这个细节查不到可靠的原始出处,只有问答网站和二手转述存疑。机制是真的,这个具体故事别当事实复述——这恰好是本页要讲的第二课:一个好指标一旦流传开,就会长出没人验证过的枝节。
委托-代理:雇了一个你看不见的人
现在拆机器。任何组织里都有两个角色:委托人(出钱的:股东、上级、业主、纳税人)和代理人(干活的:经理、柜员、医生、包工头)。委托人买的是代理人的努力,但努力本身看不见——你看得见的只有结果。麻烦在于:结果 = 努力 + 运气 + 一堆代理人改变不了的变量。委托人面对的永远是洗出来的成片,不是工作过程。
1979 年,霍尔姆斯特伦把这件事变成了可以计算的数学结构,给出两条教科书级结论公认:
第一条:信息量原理。薪酬应该挂在所有含努力信息的信号上——任何能帮你区分"努力"和"运气"的数据都不该浪费。比如用股价考核 CEO 就很粗糙:牛市里傻瓜都能涨。更好的做法是拿同业对照:别人都涨 20% 你涨 20%,含金量低;别人跌你还涨,才真有水平。把大盘的运气从成绩里滤掉,奖金才对得上努力。
第二条:风险与激励的天平。结果里的噪音由谁扛?把薪酬全押在结果上,等于让最讨厌风险的代理人(工资是他的饭碗)独自扛下全部随机波动——他会被吓得不敢动,或者要求天价风险补偿。公认瑞典皇家科学院的颁奖词把它概括为一句话:最优合约要在风险与激励之间仔细权衡。委托人看得越清楚、结果噪音越小,激励就可以开得越强;看不清、噪音大,就该多发固定工资。这不是老板大方不大方的性格问题,是结构问题。
到这一步,模型还是"单任务"的:代理人只干一件事,你只需要决定给多少强度。真实世界比这狠得多——人从来不止干一件事。下一节是本页真正的发动机。
激励强度的天平:奖金不是越大越好
直觉版的激励理论只有一句话:奖得多,干得多。霍尔姆斯特伦的模型给出的是一张更细的刻度表——激励强度不是旋钮,是天平,砝码至少有四块:
| 砝码 | 往哪边推 | 为什么 |
|---|---|---|
| 结果里的噪音 | 噪音越大,激励越弱 | 强激励=让代理人扛全部运气,风险补偿贵到付不起 |
| 代理人的风险厌恶 | 越怕风险,激励越弱 | 同上:拿饭碗赌业绩的人先求安全 |
| 任务数量 | 任务越多,单项激励越弱 | 本页 s4 的多任务模型——给一件事发奖金=变相惩罚其他事 |
| 产出可分性 | 越好单独计量,激励可越强 | 计件工人可以强激励;"维护团队士气"没法计件 |
这张表解释了两个最常见的组织错觉。错觉一:"这人拿固定工资还摸鱼,说明缺 KPI。"——也可能说明他的产出本来就测不准(基础研究者、政工干部、幼儿园老师),硬上 KPI 只会让他把精力全搬进可测量的部分,剩下的荒掉。错觉二:"发奖金是白给的甜头,总能加一点积极性。"——奖金不是甜头,是注意力分配器:你奖励什么,就是在宣布什么重要,没被奖励的自动降级。
霍尔姆斯特伦 1982 年还补了第三块:激励不一定来自钱。职业关怀(career concerns)——年轻人拼命干活,很多时候不是为了当月奖金,是为了"简历上好看、让人愿意提拔",这套隐性市场自动替雇主发激励,也自动变形(追求"可被看见的成就",回避"做成了也没人知道"的事)公认。诺贝尔奖官方材料里特别点了一句:它同样适用于政治家——记住这句,s7 讲中国的地方官员时会用到。
多任务模型:给一件事发奖金,等于给其他事降薪
1991 年,霍尔姆斯特伦和保罗·米尔格罗姆(Paul Milgrom,后来 2020 年诺奖得主,拍卖理论那篇《赢家的诅咒》的主角)合写了一篇论文,研究一个此前没人认真建模的处境:代理人同时干多件事,而委托人只看得见其中几件。公认结论短到可以印在名片上:
当任务之间互相争夺时间、而其中一部分难以测量时,最优解是把所有任务都挂上低强度激励——哪怕其中一部分明明很好测量。给可测量的任务发高奖金,等于没收其他任务。
拆开看这个"等于"。你一天八小时,分给任务 A(容易测量,比如产量)和任务 B(难测量,比如质量)。老板宣布:A 超产有奖金。注意 B 的处境变了——你花在 B 上的每小时,现在的机会成本是"少拿 A 的奖金"。没发奖金之前,B 的机会成本只是"少干点 A";发完奖金,B 被明码标了负价。三个月后产量涨了,质量垮了,老板纳闷:我又没让你们偷工减料。你没让,但你的计分方式让了。
这个模型不是空想,作者当时就点了一个战场:教师薪酬。1991 年论文原文里写着,主张按考试成绩发绩效的一方拿的是标准单任务模型("发奖金老师就更用心"),反方则指出老师会牺牲好奇心培养、创造性思维、口头书面表达——去喂那个窄得多的"标准化考试技能";论文的原话是:与其只按能测量的那几个维度发钱,不如发固定工资公认。三十四年后的"双减"、AI 时代"该考核教师什么"的争论,还在这段话的射程里。
多任务模型还有个容易被忽略的推论:拆岗位。既然任务混在一起会让激励互相打架,那就把"好测量的任务"和"难测量的任务"分给不同的人——前者挂强激励,后者给固定工资加职业声誉。车间质检员拿计件工资会出事(他有权把次品判合格),所以质检历来独立于产量线;记者不拿"发稿量"以外的钱,因为广告部和编辑部必须分墙。你以为是职业道德设计,其实是激励工程公认。
坎贝尔定律:指标一成为目标,就开始变形
苏联的钉厂、富国的柜员、济南的病床,背后是同一条规律。社会学家唐纳德·坎贝尔 1976 年的原话:
"一个量化指标越是容易被拿来当社会决策的依据,它就越容易被腐蚀性压力扭曲,也就越不适合用来监测它本来要监测的东西。"公认
大白话版:指标一旦成为目标,就不再是好指标。(经济学里常被叫作古德哈特定律,指同一件事,出自英格兰银行经济学家古德哈特 1975 年的观察。)变形有一个固定的四步循环:
这个循环最惊人的现场展演不在苏联,在亚特兰大。1990 年代末,美国"不让一个孩子掉队"法案把标准化考试分数和学校经费、校长奖金、教师去留直接挂钩。2009 年,《亚特兰大宪法报》记者注意到考卷擦改痕迹异常。州长下令调查,2011 年报告公布:抽查的 56 所学校里 44 所(78.6%)有作弊,178 名教师和校长承认或被证实改答案——有人组织"作弊聚会",戴手套擦改答题纸,警告早在 2005 年就被接到但被无视公认。学区总监贝弗莉·霍尔因为"成绩突飞猛进"刚拿了全国年度教育总监和 7.8 万美元奖金;2015 年判决,三名高管各判 20 年(7 年实刑)公认。调查报告给的原因只有一句:"在数据驱动的环境里,完成目标的压力压倒了一切。"
注意这不是"美国老师坏"。同一时期全美有 37 个州确认过考试作弊公认;反过来,中国教师对"平均分排名"的敏感、医院对"死亡率"的敏感(病危的不敢收),是同一循环的本地版。变的只有道具——只要激励足够强、测量足够窄,反应就足够歪。坎贝尔定律的可怕之处在于它的对称性:它不问你奖励的是分数还是产量还是满意度,只要"代理人对结果有强烈利害",循环就开始转。
现场盘点:四个大组织的变形实录
机制拆完了,用四个有判决书、有调查报告的现场压一压——顺带看清变形的四种典型手法。
手法一:直接造假——富国银行的 350 万个账户
交叉销售这门生意最早由西北银行(Norwest)的 CEO 科瓦切维奇在 1980 年代末搭起来;1998 年西北并入富国后,口号变成著名的"八项即伟大":每户平均持有 8 个富国产品才算合格,分行每天开晨会逐人过指标。基层柜员和客户经理的解法:用客户身份信息悄悄开户、把客户真实账户的钱挪进假账户"养活"它、捏造邮箱密码。从 2009 年前后到 2016 年曝光,累计约 350 万个未授权账户(2017 年第三方复查把最初披露的数字翻了一倍还多),5,300 名基层员工被解雇;讽刺的是被解雇的全是执行指标的基层,定指标的高管层直到多年后才被追责——内部调查早已确认高管层 2002 年就知晓这些问题,最终被追回的薪酬合计上亿美元。2020 年,该行与司法部达成认罪协议,罚 30 亿美元,承认"把业绩指标放在了客户利益之上"公认。美联储的处罚更绝——给银行的总资产设上限,禁令持续到 2025 年才解除公认。监管者的结论翻译成多任务模型的语言:你们把"产品数"这一个维度挂了超强激励,客户利益这个维度没法测量,于是它成了燃料。
顺带算一笔账,看清变形的真实比例:350 万个假账户摊到几千万户客户头上,每户不过零点几个——假账户从来不是"凑满 8 个"的手段,它是指标永远差最后一口气时的泄压阀。这更贴模型的预测:变形不需要大比例,只需要"人人都差一点,年年都要交差"推断(量级为本页换算,非监管结论)。
手法二:瞄准指标——大众排放门
2008 年前后,大众集团给美国业务定下激进销量目标,配套高管奖金与项目激励。达标有两条路:真做出更好的车,或者让测试台架上的排放数据更好看。工程团队选了第二条——在柴油发动机控制软件里装"失效保护器",平时排放超标最多 40 倍,检测时自动切换达标模式。2015 年被美国环保署揭穿,罚款与和解金累计超过 300 亿美元,多名工程师入狱公认。契约理论的教科书(Georgiadis 的综述)把它列为多任务模型的标准案例:激励可以经过"合法努力"或"作弊"两条路径达成,当作弊便宜到不值得犹豫、而测量只覆盖台架上的几十分钟,组织等于亲手选了作弊公认。
手法三:挑活儿——排队名单与病人挑选
英国公立医院系统曾按"等待名单缩短"考核医院,于是出现了系统性的病例重排:把复杂病人、高龄病人从名单上悄悄摘除或转走,留下的都是"好治的"。美国退伍军人事务部(VA)2014 年爆出候诊名单造假,员工按上级指示篡改预约日期让数据达标,一些危重病人在系统里"等了很久",实际没人安排公认。学界给这类现象起了专门的名字:病人挑选(cherry-picking)。按"平均住院日"考核医院的济南案例是它的中国近亲:DRG 付费下一个病种一个价,收治一个重症病人等于花钱买亏损,科室奖金真金白银地扣——医生的自述是"始终是罚比奖多"公认。监管的应对不是取消考核,而是给指标再补指标:把"分解住院""推诿危重""减少必要服务"逐条定义成违规行为,用大数据找"危重病例占比不合理下降"的医院公认——坎贝尔循环的第四步(换指标)正在上演。
手法四:层层加码——中国的 GDP 锦标赛
"十一五"规划中央定的年均增速目标是 7.5%,各省级政府自报目标的平均数是 10.1%,最高报到 13%推断(口径:许宪春 2021 年演讲引用的规划文本统计,单一来源,取其量级)。这不是地方官比中央激进,是锦标赛的结构:晋升名额只有一个,排名看相对位次,自报目标是一场抬价承诺——报低了先在排名预期上输一截。周黎安 2007 年把这套机制命名为晋升锦标赛,它的强激励确凿带来了增长奇迹,也确凿带来了另一面:唯 GDP、环境让路、数据注水。2013 年中央组织部正式发文"不能仅仅把地区生产总值及增长率作为考核评价政绩的主要指标",同年全国组织工作会议的原话是"再也不能简单以国内生产总值增长率来论英雄"公认。这句纠偏,用本页的语言说就是:单维度强激励的代价已经大到要给整台锦标赛换台账。
中国对位:晋升锦标赛这台机器
把镜头从企业拉到政府,多任务模型有一个五千年最大的实验场——各级政府。政府干的事几乎全部难测量:民生、法治、生态、长期风险,全是慢变量、无价签;唯一又重要又好测的就是 GDP 增速——季度发布、四级排名(国家、省、市、县四级都发布 GDP 统计,经济学家周黎安称这种四级发布在全球范围内独此一家推断:其个人观察经媒体转引,查无官方对照)。于是激励结构自动长成了教科书画的那个样子:可测量的一维拿到几乎全部激励权重。
周黎安(2004、2007)把这套机制正式命名为官员晋升锦标赛:同级官员为晋升相互竞争,考核看相对绩效,胜者上位。他同时给出了锦标赛有效运转的前提——上级承诺可信、绩效可测可比、官员之间难以合谋——并点出它的先天缺陷:当 GDP 目标与辖区居民福利冲突时,直接承受治理后果的居民无法影响官员的仕途公认。这句话拆开就是多任务模型:环境、安全、债务风险都是"任务 B",难测量、无奖金,于是它们在地方决策里的权重,取决于官员的良心和上级的督察,而不是激励结构。
必须说公平话:这台机器有它辉煌的产出。改革开放四十年的基础设施、招商引资、增长速度,换成"弱激励"的官僚系统干不出来——锦标赛是把"好测量的发展指标"推到极限的正确工具,错误不在用了它,而在只用它。周黎安本人反复强调的正是这点:锦标赛是一种激励框架,GDP 只是它曾经的一个具体指标;将来换成环保、创新、安全,锦标赛的机制照旧运转,官员的行为会跟着新指标重新变形——指标在变,循环不变公认。
2013 年之后的纠偏,恰好是本页两条原理的现场应用。第一条:加维度——中组部文件要求把民生、生态、债务、安全生产等"量不到的"逐项写进考核,权重加大。第二条:留余地——对限制开发区域取消 GDP 考核,明确"选人用人不能简单以 GDP 论英雄"。公认用霍尔姆斯特伦的话总结这轮改革:不是"少一点激励",是承认政府是多任务代理人,单一强激励必然挤压其他任务——地方主官这种岗位,从结构上就该配低强度的综合评价,而不是一张产量表。
顺带接上历史库。这套"考成"游戏中国玩了不止四十年:张居正 1573 年推考成法,给六部和地方的公文往来立台账、按月核查、逾期问责——官僚系统的响应速度立刻提上来,但考成法量的只是"办事进度",于是官场的努力涌向"台账好看":指标能过,事情未必成,人亡政息的种子当年就埋下。考成法是强激励实验,成败两端正好对上多任务模型的预测——详见《张居正改革为什么失败》。更早的病灶在和珅:议罪银把"罚俸赎罪"做成一笔进皇帝内库的生意,代理人从制度缝隙里给自己发明了第二套薪酬——这是激励结构被人钻穿的标本,详见《和珅为什么能当二十年二皇帝》。
低强度激励为什么不是躺平
读到这有人会问:照这么说,别发奖金、都发死工资,组织不就躺平了?——这正是这套理论最反直觉的地方。低强度激励不等于低努力,它换的是激励的来源和形状。已验证的解法有四件:
① 相对绩效评估:把运气滤掉,激励就能开强。s2 说过,噪音大才不敢强激励;拿同业、同城、同岗位的别人做基准,共同噪音就被减掉,剩下的差距才配得上奖金。CEO 薪酬里的"同业对照股"、地方考核里的"相对位次",都是它的产品。锦标赛其实就是相对绩效的极端形态——只留排名不留绝对数,激励极强,副作用也极强(零和博弈,见 s7)。
② 拆岗位:把打架的任务分给不同的人。好测量的活儿挂强激励,难测量的活儿配固定工资加声誉、晋升这类长期激励(职业关怀在这类岗位最有效——干得好不好,圈子看得见)。审计独立于业务、质监独立于产线、合规独立于销售,全是这条原理的岗位化公认。
③ 多维评价:承认"量不到"是常态,给 B 任务留位置。不是把所有维度都量化——那只会造出更多被瞄准的指标——而是让"没被量化的维度"有制度性的发言权:上级现场走访、同事互评、一票否决项(安全、合规)。它的本质是承认指标之外还有目的,考核表永远写不全。
④ 把激励开弱一点,把委托人的监督开强一点。这是模型的原话翻译:代理人风险大、任务杂时,固定工资 + 干得好就留任晋升,优于奖金 + 放任。医院按 DRG 付费后监管部门补的那套"分解住院认定",正是给原指标配监督的补救;银行的合规线、上市公司的内审,同款。
最后补一个容易被漏掉的教训:激励不光会影响行为,还会重新定义关系。行为经济学家 Gneezy 与 Rustichini 在以色列海法做过著名的托儿所实验:10 家托儿所,前 4 周记录基线(每周约 8 例迟到接娃),第 5 周 6 家开始对迟到罚款 10 谢克尔(约 3 美元),4 家做对照。结果罚款组的迟到翻倍并稳定下来,对照组纹丝不动;更狠的是第 17 周取消罚款后,迟到率不回落公认。解释:罚款把"给老师添麻烦"(社会规范)改写成"花钱买延时"(市场规范),价格一撤,规范也回不去了。这个实验是"激励挤出"(motivation crowding-out,Frey 与 Jegen 2001 年综述)的标志案例——外部激励会挤走本来在做工的内在动机,且挤走容易请回来难。把它放进本页的结论:激励设计不只是工程问题,在原本有责任感、荣誉感在做工的地方,上线一套精确的奖金制度之前,先想想旧引擎会不会被新引擎顶熄。
争论三卡:这套理论也有它的边界
机制解释文的惯例,收尾前把反方请上桌。这套理论的硬伤和它的洞见一样清楚。
卡一:"奖励 A 期待 B"其实是故意的?
Boettger 与 Greer 1994 年在《组织科学》上正面回击 Kerr 的名文,标题就叫《在期待 B 的同时奖励 A 的智慧》公认。他们的论点:组织里很多"奖励错位"不是失误,是政治选择——政治家奖励"表态"而非"政策效果",因为表态可观察、效果难归因;经理奖励短期利润而非长期建设,因为自己的任期就三年。也就是说,委托人自己就在进行多任务权衡:可测量的、任期内的维度本来就被他更在乎。回应:这与其说推翻了 Kerr,不如说把病从"代理人变形"升级到"委托人变形"——考核系统的荒诞,往往精准反映考核者自己的利益结构。诊断不变,药方变了:光教组织"设计好指标"没用,得先问谁在要这个指标、他要它干什么。
卡二:监控越强,机制会失效吗?
算法管理的信徒会说:委托-代理问题源于"看不见",装满传感器、数字平台全程留痕,问题不就消失了?理论回答:看得见只解决了"有没有数据",没解决"数据对不对得上目的"。外卖平台的算法把配送时间压到极限,骑手用逆行、闯红灯响应——平台"看得见"的是送达分钟数,看不见的是交通安全,多任务结构原封未动,只是强度更高了推断(机制推演;个案与实证因平台而异,不引具体数字)。监控技术改变的是天平的刻度,不是天平本身。测量成本下降的真正含义是:以前因为"测不了"而只能靠责任心的维度,现在也可能被挂上激励、然后被瞄准——坎贝尔定律获得了更多登陆场。
卡三:激励挤出的边界在哪里?
托儿所实验著名,但它的适用范围有明确限定:罚款金额小(3 美元)、关系本来是社会规范的领域。后来者的研究给出的边界大致是:任务越偏创造性与关系维护,挤出越明显;任务越机械可标准化,金钱激励越安全公认(Frey 与 Jegen 综述的自我限定:效应强于"微观经济学的标准假设",但强度因情境差异很大)。车间计件工资没有垮,恰恰因为计件的活儿本来就少有"内在动机"可挤。所以"激励挤出"不是反奖金宣言,是划界工具:它告诉你哪些岗位千万别用 KPI 丈量——不是那些岗位不重要,而是那些岗位的旧引擎(责任感、专业荣誉、长期声誉)比新引擎功率大得多。
随身四问与接线
机制讲完,兑换成可随身携带的判断。以后遇到任何 KPI、任何绩效方案、任何"重奖之下必有勇夫",按顺序问四句:
| 问题 | 在查什么 |
|---|---|
| ① 量不到的那一半,谁干? | 多任务结构:有没有难测量的任务正在被这套指标变相降薪(质量/安全/口碑/长期) |
| ② 这个指标成为目标之后,会先死掉什么? | 坎贝尔循环:谁最有动力、最有条件在指标上做策略性反应 |
| ③ 激励强度和噪音匹配吗? | 风险天平:结果里运气占比多大,强激励是不是在让人赌命,有没有同业对照滤运气 |
| ④ 原来靠什么管住这件事? | 挤出检查:奖金上线之前,责任感/声誉/规范是不是正在免费做工 |
四问合起来的世界观只有一句:考核表是组织的注意力分配器,改考核表就是改组织的眼睛。多数组织不是不知道 B 任务重要,只是 B 任务没有价签——而没有价签的东西,在强激励系统里自动排序最后。
接线
《科层制——为什么组织最后都长成一个样》(跨科·社会学):韦伯讲组织为什么长成六零件机器,本页讲机器装好之后,里面的人为什么长成考核表的样子——那页 s9 的"绩效指标"反功能(默顿的目标置换)在本页拿到 2016 诺奖级的机制版;科层制执着于"可比较可排序可辩护"的筛选依据,本页解释了代价:一旦可辩护的维度挂上激励,不可辩护的维度自动让位。
《张居正改革为什么失败》(跨科·历史学):考成法是 1573 年版的强激励实验——立台账、按月查、逾期罚,官僚响应速度立竿见影;但它量的只有"进度",于是台账与实事分家,人亡政息。成败两端正好是本页模型的两个预测:强激励必有响应,响应必沿指标变形。
《和珅为什么能当二十年二皇帝》(跨科·历史学):议罪银是代理人失控的清代标本——正式激励之外,代理人自己发明了一套"罚款换平安"的现金流,委托人(皇帝)默许它运转二十年。激励结构一旦有缝,长出来的东西不会按你的初衷。
《柠檬市场——劣币驱逐良币的完整工艺》:信息不对称的上下两半。那页是签约前看不清对方的底细(逆向选择),解药是信号与担保;本页是签约后看不清对方的努力(道德风险),解药是合约设计与激励强度。那页 s0 明写"道德风险不写"——本页就是那笔欠账。
《赢家的诅咒——出价最高的那个先亏》:同体裁的兄弟篇,主角同一位(米尔格罗姆)。那页讲"结果本身会骗人"(赢=坏消息),本页讲"测量本身会骗人"(量=导向)——两页合读,恰好覆盖契约理论里"信息"的两个面。
《创造性破坏——增长的秘密》(同科):那页的"守门人关机键"讲了在位者怎么掐掉新技术,本页补了同一件事的日常版本:错误的激励每天都在组织内部掐掉"量不到的创造性任务"——多任务模型里最先死掉的,永远是培养好奇心那种"不好测量、明年才见效"的事。
十句话
- 绩效奖金付的不是"业绩",是"业绩里你看得见的那部分"——代理人会把你看得见的部分做到极限,其余消失。
- 量什么有什么,量不到的消失:这不是人心坏,是任何理性人对激励结构的标准反应。
- 委托-代理的死结:你买的是努力,合约却只能签在结果上,而结果里混着运气。
- 激励强度不是越大越好:结果噪音越大、任务越多,越该多发固定工资——这是算出来的,不是心软。
- 给一件事发奖金,等于给其他事降薪:同一副肩膀,A 的奖金就是 B 的机会成本。
- 指标一旦成为目标,就不再是好指标:亚特兰大 44 所学校改答案,靠的不是 178 个坏人,是一台运转正常的机器。
- 强激励必有响应,响应必沿指标变形——苏联两轮换指标(1965/1979),每一轮都照样被绕开。
- 低强度激励不是躺平:拆岗位、相对绩效、多维评价、加强监督,四件工具都比"一维重奖"耐用。
- 激励会重新定义关系:海法托儿所的罚款把愧疚改写成价格,撤掉罚款也回不去了。
- 改考核表就是改组织的眼睛:看到任何 KPI,先问一句——量不到的那一半,谁干?
来源与免责
文献与依据
- Nobel Prize 官方新闻稿(2016):Holmström 信息量原理与风险-激励权衡;多任务与团队生产的推广。nobelprize.org
- Holmström, B. (1979). "Moral Hazard and Observability." Bell Journal of Economics 10(1)——信息量原理原始论文
- Holmström, B. & Milgrom, P. (1991). "Multitask Principal-Agent Analyses." Journal of Law, Economics, & Organization 7——多任务模型;教师按考分发钱的争论在原文中已预演
- Holmström, B. (1982). "Managerial Incentive Problems—A Dynamic Perspective."——职业关怀(career concerns)
- Kerr, S. (1975). "On the Folly of Rewarding A, While Hoping for B." Academy of Management Journal 18(4);1995 年更新版 Academy of Management Executive 9(1)
- Boettger, R. & Greer, C. (1994). "On the Wisdom of Rewarding A While Hoping for B." Organization Science 5(4)——反方卡素材
- Newsweek(1957):古比雪夫制钉厂按数量/重量考核变形的报道;《鳄鱼》(Krokodil)1954 年第 5 期巨型钉漫画
- 美国司法部新闻稿(2020-02):富国银行 30 亿美元和解与认罪协议;国会众议院金融服务委员会报告(2019):350 万账户、5,300 解雇、2017 年取消销售配额;AP(2025-06):美联储解除 2018 年资产上限
- 佐治亚州州长办公室调查报告(2011):亚特兰大学区 56 所抽查 44 所、178 人作弊、"数据驱动环境的压力";2015 年判决报道(Common Dreams / AJC);坎贝尔定律原文引用(Campbell 1976)
- 央广网(2024-06-17)《困在转院"潜规则"中的重症患者》:济南三甲医院 15—20 天限期转院、DRG 付费、科室扣款;人民日报健康客户端《限期住院不该一刀切》:国家从未出台"住院不超 15 天"规定、三级医院平均住院日 7.6 天;百色市医保局 DRG 考核文件(2021):分解住院/推诿危重/减少服务的违规认定定义
- 周黎安(2004/2007/2018)晋升锦标赛系列论文与文献综述(北京大学光华管理学院);中央组织部《关于改进地方党政领导班子和领导干部政绩考核工作的通知》(2013-12);人民网评《从晋升锦标赛看"唯GDP论"》(2013-11)
- Gneezy, U. & Rustichini, A. (2000). "A Fine Is a Price." Journal of Legal Studies 29(1):海法 10 家托儿所 20 周田野实验
- Frey, B. & Jegen, R. (2001). "Motivation Crowding Theory." Journal of Economic Surveys 15(5)——激励挤出综述(含作者自我限定)
- Georgiadis, G. 《Contracting with Moral Hazard: A Review of Theory & Empirics》——多任务模型综述,大众排放门列为标准案例
- Goodhart, C. (1975) 货币政策观察(古德哈特定律出处);坎贝尔定律另一通行名
免责
本页所有结构性解释只是在本库口径下的一种读法,不是学界定论。对普通人有什么用是本库的使用建议,不是学界共识。