Abstract
大多数组织将行为经济学视为一份偏见词汇表:命名机制,应用机制,然后假设其有效。四项经过独立验证的随机对照试验——涵盖了经济援助、刑事司法、家庭能源和选民投票率——证明即使是设计这些干预措施的研究人员也无法提前预测结果。这种不可预测性正是主张测试而非假设的全部理由。本文介绍了证据循环(Evidence Loop):一个五阶段框架和四部分工具包,用于将借鉴的行为洞察转化为关于您自身人群的经过测试的主张。
Key findings
- 消除文书工作中的摩擦(而非说服)使大学入学率提高了 8 个百分点;仅提供信息的效果要弱得多(Bettinger 等人,QJE,2012)。
- 在法院罚款短信中加入债务人姓名,使平均支付额比没有提醒时提高了 189%,并且在通用提醒的基础上又增加了 34%(Haynes 等人,2013)。
- 重新设计住宅能源账单,以显示邻居的用电量,使 60 万户家庭的用电量减少了 2.0%——相当于电价上涨 11-20%,而成本几乎为零(Allcott,Journal of Public Economics,2011)。
- 要求选民陈述具体的投票计划——地点、时间、方式——使单选民家庭(N = 287,228)的投票率提高了 9.1 个百分点(Nickerson & Rogers,Psychological Science,2010)。
- 全球 200 多家机构现在将行为洞察应用于公共政策;2025 年 9 月,迪拜的 MBRSG 启动了迪拜行为洞察实验室,以在本地测试干预措施,而不是未经测试地引入研究结果(OECD;MBRSG,2025)。
深度探索
大多数行为经济学内容所忽略的学科
如果问一群商业领袖行为经济学在实践中意味着什么,他们会提到某种偏误——损失厌恶、锚定效应、社会认同。但几乎没有人会提到这样一门学科:它将真正的行为洞察部门与一份带有偏误词汇表的幻灯片区分开来,这门学科就是:在相信某个干预措施在此地、针对此人群、通过此渠道有效之前,习惯性地进行真正的随机对照试验。
“偏误是真实存在的。著名的研究也是真实存在的。但它是否适用于您的人群、您的渠道、您的特定行为——这部分从未经过测试。它被想当然了。”
这种差距——从知道存在某种偏误到知道它将在您的情境中产生可衡量的效果——正是《证据循环》旨在弥合的。
四项试验。四个 EAST 杠杆。零个显而易见的结果。
本文的证据基础是四项经过独立验证的随机对照试验,每项试验都展示了 EAST 框架(Easy, Attractive, Social, Timely)中的一个杠杆,每项试验的规模都排除了巧合的可能性,并且每项试验都产生了一个事先看来绝非显而易见的结果。
- Easy(简易)— 经济援助 (Bettinger et al., QJE, 2012): 帮助家庭使用现有数据完成复杂的援助申请,使大学入学率提高了 8 个百分点。仅提供信息——告诉家庭他们有资格获得什么——产生的效果要弱得多。摩擦,而非意识差距,是主要的限制因素。
- Attractive(有吸引力)— 法院罚款 (Haynes et al., 2013): 任何提醒支付未缴罚款的短信都使平均支付额增加了 145%。加上债务人的姓名,这一数字增至 189%。仅个性化——相同的信息,针对姓名而非类别——产生了可衡量、可分离的效果。
- Social(社会性)— 家庭能源 (Allcott, Journal of Public Economics, 2011): 向家庭展示其用电量与附近类似家庭的比较,在 60 万户家庭中平均减少了 2.0% 的用电量——相当于在不触及价格的情况下实现了 11-20% 的价格上涨。这种效应主要集中在用电量最大的用户(-6.3%)中,而那些已经低于平均水平的用户几乎没有变化(-0.3%)。
- Timely(及时)— 选民投票率 (Nickerson & Rogers, Psychological Science, 2010): 在一项针对 287,228 人的实地实验中,要求人们阐明具体的投票计划——时间、地点、之前要做什么——使单选民家庭的投票率提高了 9.1 个百分点。提示中没有包含关于选举的新信息;只有具体性和时间发生了变化。
Renascence 的观点
行为经济学的列表式版本将每种偏误都视为一个可转移的事实。但这四项试验却并非如此。没有一个研究团队假设他们的干预措施会奏效——他们进行试验正是因为结果并不明显。FAFSA 的研究人员并不知道仅凭信息的效果会如此显著地不足。能源研究人员并不知道这种效应会如此集中地出现在用电量最高的家庭中。
“大多数行为经济学内容将偏误作为洞察力来推销。真正的洞察力是,即使是那些以研究这些偏误为生的人,也不相信自己的预测足以跳过试验。”
Renascence 的立场是:任何借鉴本文中机制的组织都应将其视为一个值得在其自身情境中进行测试的假设——而不是一个可以直接部署的既定事实。
证据循环框架
本文的后半部分介绍了证据循环:一个五阶段循环——假设、设计、测试、决策、推广或放弃——其中“测试”是所有四个案例研究实际存在的关键环节。配套的 EAST 杠杆图显示了哪个杠杆与哪种类型的摩擦相匹配,以及在哪里进行首次测试。
工具包——本周即可使用的四种工具
- 工具 01 · EAST 机会扫描: 一个五分钟的诊断工具,用于评估每个杠杆是未被使用、未被审查,还是经过精心设计和测试的。
- 工具 02 · 假设与测试卡: 一页纸的协议,用于设计真正的测试——行为、杠杆、对照组、变体、随机分配方法、单一指标和预先承诺的决策规则。
- 工具 03 · 最小可行 RCT 严谨性检查表: 用于检查计划中的测试是真正的随机试验还是披着实验外衣的推广的理智检查。
- 工具 04 · 测试结果分类账: 一个持续记录,将个体测试转化为机构记忆——包括失败的测试,这才是真正证据基础的建立之处。
谁需要这份文件
CX 领导者、行为洞察实践者、政策团队和转型负责人,他们曾从案例研究中借鉴行为机制,并希望了解它是否真的适用于他们的人群——以及如何建立能够可靠、大规模地回答这个问题的测试规范。
区域信号
海湾地区正在直接建立这种能力,而不是引入结论。2025 年 9 月,迪拜的穆罕默德·本·拉希德政府学院启动了迪拜行为洞察实验室——一个旨在在真实政府环境中测试干预措施的应用平台。其首个倡议是 2025 年 11 月与迪拜 GDRFA 合作举办的结构化“助推马拉松”,将行为科学方法应用于居留和身份服务。目前尚未公布结果;诚实的信号是,正在建设的是测试而非仅仅借鉴的基础设施。
Download whitepaper
Turn this thinking into measurable experience outcomes.