ECON3124 行为经济学学了什么:从核心理论到期末复习的完整笔记

ECON3124 行为经济学学了什么:从核心理论到期末复习的完整笔记

AdenXie

ECON3124 是 Behavioural Economics,也就是行为经济学。它并不是把“人不理性”当成一句结论,而是在标准经济学模型之上,系统追问三个问题:人的偏好究竟如何偏离标准模型?人的信念为什么会系统性出错?当这些人互相博弈时,市场结果和公共政策又会发生什么变化?

在完整复习这门课的过程中,我逐渐把分散在讲义、Tutorial 和模拟题中的内容整理成了一套相互关联的框架,并采用概念识别、公式建模、独立做题、错误诊断和定向重测的循环加深理解。下面既是一份课程知识地图,也是一篇关于如何系统复习行为经济学的总结。

一、整门课的主线:标准模型在哪里失效

我最后把课程理解为四层结构:

  1. 标准基准:概率、贝叶斯更新、期望效用、指数贴现、纳什均衡与逆向归纳。
  2. 偏好偏差:参照依赖、损失厌恶、现在偏误、投射偏差、信念效用和社会偏好。
  3. 信念与推理偏差:代表性、可得性、锚定、有限层级推理、受诅咒思维与错误学习。
  4. 市场和政策后果:信息回避、赢家诅咒、路径依赖、内在性,以及助推与软家长主义。

这条主线很重要,因为考试中的新情境往往不会直接告诉你“这是损失厌恶题”或“这是现在偏误题”。真正要做的是先写出标准模型的预测,再判断数据或行为为何与它不一致,最后选择能够解释该差异的行为模型。

一个很实用的英文答题骨架是:

Define the concept → explain the mechanism → derive its prediction → connect the prediction to the evidence.

也就是:定义概念—解释机制—推出预测—联系证据

二、风险、贝叶斯更新与参照依赖

1. 贝叶斯公式不是背完就会

贝叶斯公式是课程前段的基础:

真正容易错的不是公式本身,而是把假阳性和假阴性混在一起。例如患病率为 ,灵敏度为 ,假阳性率为 。设想 10,000 人:100 人患病,其中 99 人阳性;9,900 人未患病,其中也有 99 人阳性。因此阳性者实际患病的概率只有

我最初也会把分母写乱。后来最有效的办法不是继续背符号,而是画四格表,并牢记:分子是真阳性,分母是全部阳性,即真阳性加假阳性。任何长分母都加括号,能避免很多低级计算错误。

2. 期望效用、确定性等价与风险溢价

标准期望效用模型写作:

确定性等价 满足 ,风险溢价则是

凹效用函数意味着边际效用递减,因此风险厌恶者愿意牺牲一部分期望财富来消除风险。这里要区分“厌恶损失”和“厌恶风险”:前者依赖参照点,后者在标准模型中由财富效用的曲率解释。

3. 前景理论:结果取决于从哪里看

带参照点的效用可以写成:

前景理论的简化表达是:

它包含三块核心内容:

  • 参照依赖:人评价的常常不是最终财富,而是相对某个参照点的得失。
  • 损失厌恶:同样大小的损失带来的痛苦,大于收益带来的快乐。
  • 敏感度递减与概率加权:离参照点越远,额外变化的心理冲击越弱;人还可能高估小概率、低估中高概率。

这可以解释禀赋效应。若收益区间斜率为 1、损失区间斜率为 2,一只杯子带来的消费价值为 4,那么没有杯子的人最高愿付约 2,而已经拥有杯子的人最低愿收约 8。买价与卖价的差距不是收入变化,而是交易在不同参照点下被编码成收益或损失。

出租车司机的“收入目标”也是典型例子:每日目标成为参照点后,低收入日反而更愿意继续工作,高收入日更早收工,这与只看当小时工资的标准劳动供给模型不同。

三、时间偏好:为什么明知应该做,却总是明天再做

1. 指数贴现与动态一致性

指数贴现模型为:

其关键性质是动态一致性:只要结果之间的时间间隔不变,人对同一组未来选项的相对偏好不会仅仅因为时间流逝而反转。复习时我最初把动态一致性写得过于模糊,后来才意识到,答案必须明确包含“同一未来选项”和“不会随时间反转”这两个部分。

2. 模型与现在偏误

准双曲贴现写作:

表示常规耐心程度, 则给“现在”额外权重。它能解释拖延、冲动消费、成瘾与储蓄不足。

这里必须区分两类人:

  • **天真型(naive)**知道自己现在会拖延,却错误相信未来的自己会按原计划执行。
  • **成熟型(sophisticated)**预见未来自己仍有现在偏误,因此会逆向归纳,也可能主动寻求承诺装置。

一道很好的任务成本题是:四期完成任务的成本分别为 8、12、18、27,且 。天真型不断认为“下一期做更划算”,最后拖到成本 27;成熟型会预测未来自己的选择并逆推,可能在第一期承担成本 12 的下一步结果,而不是一直比较表面的相邻数字。做这类题时,不能只比下一期名义成本,必须比较延迟后真正会发生的路径

更微妙的是有害消费。若每次消费当期获得 4、支付价格 2、未来损害为 3,且 ,当前自我看到的边际收益为

所以每一期都可能选择消费;但任何一个自我在事前评价整条持续消费路径时,又可能希望它从未发生。这就是“每次都自愿”并不必然等于“整条路径符合长期福利”。

四、投射偏差、信念效用与信息回避

1. 投射偏差

人在饥饿、口渴、疼痛或兴奋时,会高估未来仍处于相同状态的程度。课程中的一种表达为:

在这套讲义的约定里, 表示准确预测, 表示完全投射。不过不同教材有时会交换两项的顺序,所以比死记“参数越大越偏”更可靠的方法,是考试时直接读公式:哪个权重乘在当前状态上,哪个权重才代表投射强度

我做题时还踩过一个很典型的坑:把状态变量和效用混为一谈。未来饥饿状态可能是 ,但在该状态下吃汉堡的效用可能是 2;这两个数字含义完全不同。

2. 信念也能直接产生效用

标准模型中,信念只用于选择行动;行为模型允许“相信自己健康、聪明或被喜欢”本身带来效用。这会产生信息回避和自我欺骗。

如果获得信息前的信念为 ,信息后信念为 ,心理效用函数 为凹函数,那么 Jensen 不等式可能给出:

即使信息具有工具价值,它造成的信念波动也可能降低预期心理效用,于是人选择不检测、不看账单或不查考试结果。计算心理成本时,必须对好消息和坏消息按概率加权;不能只拿某一个坏结果与当前状态比较。

自我欺骗题还要求同时使用两种概率:客观概率决定行动的物质回报,主观且更乐观的概率决定信念效用。若一个人不做检测,他通常无法在两个真实状态中都采取正确行动。这一点是判断信息价值的核心。

五、判断启发式、选择架构与心理账户

这一部分概念很多,但可以压缩为“判断如何被呈现方式改变”。

1. 三种经典启发式

  • 代表性:因为描述看起来像某一类型,就忽略基础概率。Linda 问题中的合取谬误违反了
  • 可得性:越容易被想起的事件,被判断为越常见。媒体对罕见事故的密集报道会放大风险感知。
  • 锚定:先出现的数字即使无关,也会拉动后续估计。

这里最有效的答法不是只写偏差名称,而是指出被忽略的规范基准,例如基础概率、集合包含关系或与锚无关的真实信息。

2. 偏好不是随身携带的固定清单

诱饵效应、折衷效应、选择过载和默认选项说明,偏好会在选择现场被构造出来。标准模型预测加入一个劣势选项不应改变原有两项的排序;如果排序改变,说明菜单本身参与塑造了偏好。

3. 狭窄框架与心理账户

人在分别评价两场赌博时,可能选择 A 和 D;把它们合并后,B+C 却在每个状态都多 10。问题并不是不会算期望值,而是只在局部账户中判断每一次风险,没有整合总财富结果。保险、投资、优惠券和沉没成本题经常使用这一机制。

六、社会偏好与行为博弈论

1. 先掌握标准博弈论基准

纳什均衡的判断标准只有一个:固定其他人的策略,没有任何玩家愿意单方面偏离。不能用“大家都更幸福”或“总收益更高”代替它。序贯博弈则从最后节点开始做逆向归纳。

2. 结果公平:Charness–Rabin 型偏好

以玩家 2 为例,一种分段效用为:

Unknown environment 'cases'

计算前必须先看玩家 2 是领先还是落后,再选择对应分支。社会偏好可能改变最佳反应,从而改变纳什均衡。

3. 结果相同,意图不同

分配偏好只看最终支付;意图与互惠模型还看对方本来可以怎么选。最后都是 ,但若提议者可以在公平分配与 之间选择,拒绝率往往高于他根本没有更公平选项的情形。考试中看到“相同结果、不同菜单或未选选项”,就应优先想到 intentions、reciprocity、moral wiggle room 或 face-saving,而不只是结果不平等。

七、有限战略推理、受诅咒思维与学习

1. Beauty Contest 不能只做一次直接调整

若比例规则为 ,完全非战略者占比 并选择 50,理性参与者都选择 ,总体平均值为

理性者的最优选择满足 ,所以

时,答案是

我复习时发现,这里最容易漏掉的是理性玩家之间的反馈:不能只把 20% 的非理性选择直接乘进去,还要让自己的选择重新进入总体平均数。

Level- 模型则把有限推理层级写得更直观:若 ,则

例如 时,各层级依次为 50、40、32、25.6。

2. 信息投射、受诅咒思维与赢家诅咒

在含私人信息的博弈里,行动本身会泄露信号。受诅咒的玩家低估“行动与私人信息之间的相关性”,因此更新不足。一个很短的答题句是:

Actions reveal signals; cursed agents under-update from those actions.

共同价值拍卖中的赢家诅咒来自选择效应:赢标往往意味着自己的估值相对最乐观,因此

理性竞标者必须以“我赢了”为条件重新估值并压低报价,而不能直接按无条件估值出价。

3. 学习不一定收敛到同一个结果

课程比较了强化学习、信念学习和 EWA 等机制。强化学习更依赖已选择行动的实际回报,信念学习会更新对其他人策略的判断,EWA 则试图统一二者。

路径依赖实验进一步说明:微小的初始差异可能通过正反馈把群体推向不同稳定点,例如最终集中在 3 或 12。短期历史并不只是噪声,它可能永久改变长期结果。

八、行为福利经济学:什么时候应该干预

行为政策的核心不是看到偏差就立刻禁止,而是识别内在性(internality):今天的选择给未来自己造成、但今天没有充分计入的成本。

在一个简化模型中,若未来损害为 ,现在偏误参数为 ,折现因子为 ,纠偏税可写为:

它不是传统外部性税:受损者与决策者是同一个人的不同时间自我。

政策工具可以按干预强度理解:

  • 自由意志家长主义:保留选择自由,例如默认加入但允许退出。
  • 非对称家长主义:主要帮助会犯错的人,同时尽量少妨碍理性选择者。
  • 稳健家长主义:即使对行为参数估计不精确,也能在较广条件下提高福利。

课程中的工具包括默认选项、主动选择、冷静期、承诺装置、信息披露和持久选择。一个完整政策答案应按“偏差—内在性—工具—福利成本”展开,而不是只说“设置默认项就好”。默认项也可能误导异质人群,税收也可能惩罚本来就理性的人,因此必须讨论误伤与退出成本。

九、最值得放进 Cheat Sheet 的公式与辨析

模块 最小公式或判断句 高频陷阱
贝叶斯 后验 = 真阳性 / 全部阳性 混淆假阳性与假阴性
期望效用 把期望财富直接代替期望效用
前景理论 结果相对参照点编码 把损失厌恶等同于一般风险厌恶
现在偏误 当期无 ,所有未来项乘 忘记 naive 与 sophisticated 的预期不同
投射偏差 当前状态污染未来效用预测 混淆状态值与状态下的效用
信息回避 比较工具价值与心理成本 忘记给好坏消息加概率权重
纳什均衡 固定他人策略,检查单边偏离 用帕累托最优代替均衡条件
社会偏好 先判断谁领先,再选分段函数 混淆结果公平与意图互惠
Beauty Contest 同时解 忽略理性玩家之间的反馈
赢家诅咒 以“赢标”为条件更新估值 按无条件价值直接竞标
行为政策 偏差 → 内在性 → 工具 → 福利 只说助推,不讨论异质性和成本

还有几类纯计算错误特别值得记录:独立事件的连续概率要相乘,例如两次连续成功是 ;移项时要逐步检查不等号,例如 推出的是 ;多层分母必须加括号。这些错误与理论无关,却最容易在时间压力下丢分。

十、我的完整复习方法:不只追求“看完”,更要追求“能识别”

完整复习可以按知识之间的关联分阶段进行:先覆盖风险、时间偏好、信念与启发式,再处理博弈论和社会偏好,最后完成有限推理、学习、政策分析与模拟题。这样的顺序能让后面的行为模型建立在清晰的标准模型基准之上,也便于在综合题中连接多个模块。

对我最有效的循环是:

  1. 用一句话说清概念的规范基准与偏离方向。
  2. 看一个完整例题,观察如何从文字识别模型。
  3. 不看答案独立做一道同类题。
  4. 把错误标成“概念识别、公式设定、代数计算、机制表达”四类之一。
  5. 只针对错误类型再做一道题,而不是从头重读整章。

贝叶斯就是一个典型案例:第一次错在假阳性,画四格表后重测才真正掌握。Beauty Contest 则错在遗漏均衡反馈,重新联立方程后才理解模型。动态一致性的问题不是不会概念,而是定义不够精确;社会偏好题的问题则是没有先检查效用函数分支。把错误归类以后,复习速度明显快于反复看讲义。

安排复习优先级时,我认为可以采用下面的顺序:

  1. 第一优先:贝叶斯、期望效用、前景理论、、投射偏差、信息回避。
  2. 第二优先:纳什均衡、逆向归纳、社会偏好、意图、Beauty Contest、Level-
  3. 第三优先:受诅咒思维、赢家诅咒、学习模型、内在性与政策比较。
  4. 最后补充:实验名称和零散事实;它们应挂在机制上记,而不是孤立背诵。

模拟卷也不能机械当成真实权重。我们手上的 Mock Final 明确比正式考试短,只有两道大题;真正值得迁移的是题型结构:给一个陌生情境,再连续要求计算、解释机制、比较模型并提出政策含义。

考场上我会用三套短模板:

  • 理论题:标准模型预测不变;观察到的变化支持某行为机制,因为……
  • 计算题:写公式—代入数字—比较候选项—用一句话解释经济含义。
  • 政策题:识别偏差—说明内在性—选择工具—讨论福利收益、误伤和退出成本。

十一、学完 ECON3124 后,我真正带走了什么

这门课最有价值的地方,不是提供一张“人类偏差清单”,而是教人以可检验的方式讨论非理性。一个行为解释必须说明基准模型是什么、偏离从哪里进入效用或信念、它会产生什么不同预测,以及实验和现实数据能否区分这些模型。

它也改变了我看待政策的方式。人在某个时刻作出选择,并不保证那个选择代表长期福利;但发现行为偏差,也不自动赋予政策制定者无限干预的权力。好的行为政策需要同时尊重异质性、选择自由和纠错收益。

对复习本身也是如此:真正的进步并不来自“今天看了多少页”,而来自能否在新题里识别机制、写出正确模型、解释结果,并知道自己上一次究竟错在哪里。对我而言,这正是完整复习 ECON3124 后最值得保留下来的经验。

本文根据我修读学期的 ECON3124 讲义、Tutorial、模拟题与个人复习对话整理,公式符号和考核重点可能随学期调整,请以当期课程材料为准。

封面摄影:Kaboompics.com / Pexels

  • 标题: ECON3124 行为经济学学了什么:从核心理论到期末复习的完整笔记
  • 作者: AdenXie
  • 创建于 : 2026-08-28 20:20:54
  • 链接: https://blog.adenxie.com.cn/2026/08/28/2026-08-28-econ3124-behavioural-economics-review/
  • 版权声明: 版权所有 © AdenXie,禁止转载。
评论