ECON3124 行为经济学学了什么:从核心理论到期末复习的完整笔记
ECON3124 是 Behavioural Economics,也就是行为经济学。它并不是把“人不理性”当成一句结论,而是在标准经济学模型之上,系统追问三个问题:人的偏好究竟如何偏离标准模型?人的信念为什么会系统性出错?当这些人互相博弈时,市场结果和公共政策又会发生什么变化?
在完整复习这门课的过程中,我逐渐把分散在讲义、Tutorial 和模拟题中的内容整理成了一套相互关联的框架,并采用概念识别、公式建模、独立做题、错误诊断和定向重测的循环加深理解。下面既是一份课程知识地图,也是一篇关于如何系统复习行为经济学的总结。
一、整门课的主线:标准模型在哪里失效
我最后把课程理解为四层结构:
- 标准基准:概率、贝叶斯更新、期望效用、指数贴现、纳什均衡与逆向归纳。
- 偏好偏差:参照依赖、损失厌恶、现在偏误、投射偏差、信念效用和社会偏好。
- 信念与推理偏差:代表性、可得性、锚定、有限层级推理、受诅咒思维与错误学习。
- 市场和政策后果:信息回避、赢家诅咒、路径依赖、内在性,以及助推与软家长主义。
这条主线很重要,因为考试中的新情境往往不会直接告诉你“这是损失厌恶题”或“这是现在偏误题”。真正要做的是先写出标准模型的预测,再判断数据或行为为何与它不一致,最后选择能够解释该差异的行为模型。
一个很实用的英文答题骨架是:
Define the concept → explain the mechanism → derive its prediction → connect the prediction to the evidence.
也就是:定义概念—解释机制—推出预测—联系证据。
二、风险、贝叶斯更新与参照依赖
1. 贝叶斯公式不是背完就会
贝叶斯公式是课程前段的基础:
真正容易错的不是公式本身,而是把假阳性和假阴性混在一起。例如患病率为
我最初也会把分母写乱。后来最有效的办法不是继续背符号,而是画四格表,并牢记:分子是真阳性,分母是全部阳性,即真阳性加假阳性。任何长分母都加括号,能避免很多低级计算错误。
2. 期望效用、确定性等价与风险溢价
标准期望效用模型写作:
确定性等价
凹效用函数意味着边际效用递减,因此风险厌恶者愿意牺牲一部分期望财富来消除风险。这里要区分“厌恶损失”和“厌恶风险”:前者依赖参照点,后者在标准模型中由财富效用的曲率解释。
3. 前景理论:结果取决于从哪里看
带参照点的效用可以写成:
前景理论的简化表达是:
它包含三块核心内容:
- 参照依赖:人评价的常常不是最终财富,而是相对某个参照点的得失。
- 损失厌恶:同样大小的损失带来的痛苦,大于收益带来的快乐。
- 敏感度递减与概率加权:离参照点越远,额外变化的心理冲击越弱;人还可能高估小概率、低估中高概率。
这可以解释禀赋效应。若收益区间斜率为 1、损失区间斜率为 2,一只杯子带来的消费价值为 4,那么没有杯子的人最高愿付约 2,而已经拥有杯子的人最低愿收约 8。买价与卖价的差距不是收入变化,而是交易在不同参照点下被编码成收益或损失。
出租车司机的“收入目标”也是典型例子:每日目标成为参照点后,低收入日反而更愿意继续工作,高收入日更早收工,这与只看当小时工资的标准劳动供给模型不同。
三、时间偏好:为什么明知应该做,却总是明天再做
1. 指数贴现与动态一致性
指数贴现模型为:
其关键性质是动态一致性:只要结果之间的时间间隔不变,人对同一组未来选项的相对偏好不会仅仅因为时间流逝而反转。复习时我最初把动态一致性写得过于模糊,后来才意识到,答案必须明确包含“同一未来选项”和“不会随时间反转”这两个部分。
2. – 模型与现在偏误
准双曲贴现写作:
这里必须区分两类人:
- **天真型(naive)**知道自己现在会拖延,却错误相信未来的自己会按原计划执行。
- **成熟型(sophisticated)**预见未来自己仍有现在偏误,因此会逆向归纳,也可能主动寻求承诺装置。
一道很好的任务成本题是:四期完成任务的成本分别为 8、12、18、27,且
更微妙的是有害消费。若每次消费当期获得 4、支付价格 2、未来损害为 3,且
所以每一期都可能选择消费;但任何一个自我在事前评价整条持续消费路径时,又可能希望它从未发生。这就是“每次都自愿”并不必然等于“整条路径符合长期福利”。
四、投射偏差、信念效用与信息回避
1. 投射偏差
人在饥饿、口渴、疼痛或兴奋时,会高估未来仍处于相同状态的程度。课程中的一种表达为:
在这套讲义的约定里,
我做题时还踩过一个很典型的坑:把状态变量和效用混为一谈。未来饥饿状态可能是
2. 信念也能直接产生效用
标准模型中,信念只用于选择行动;行为模型允许“相信自己健康、聪明或被喜欢”本身带来效用。这会产生信息回避和自我欺骗。
如果获得信息前的信念为
即使信息具有工具价值,它造成的信念波动也可能降低预期心理效用,于是人选择不检测、不看账单或不查考试结果。计算心理成本时,必须对好消息和坏消息按概率加权;不能只拿某一个坏结果与当前状态比较。
自我欺骗题还要求同时使用两种概率:客观概率决定行动的物质回报,主观且更乐观的概率决定信念效用。若一个人不做检测,他通常无法在两个真实状态中都采取正确行动。这一点是判断信息价值的核心。
五、判断启发式、选择架构与心理账户
这一部分概念很多,但可以压缩为“判断如何被呈现方式改变”。
1. 三种经典启发式
- 代表性:因为描述看起来像某一类型,就忽略基础概率。Linda 问题中的合取谬误违反了
。 - 可得性:越容易被想起的事件,被判断为越常见。媒体对罕见事故的密集报道会放大风险感知。
- 锚定:先出现的数字即使无关,也会拉动后续估计。
这里最有效的答法不是只写偏差名称,而是指出被忽略的规范基准,例如基础概率、集合包含关系或与锚无关的真实信息。
2. 偏好不是随身携带的固定清单
诱饵效应、折衷效应、选择过载和默认选项说明,偏好会在选择现场被构造出来。标准模型预测加入一个劣势选项不应改变原有两项的排序;如果排序改变,说明菜单本身参与塑造了偏好。
3. 狭窄框架与心理账户
人在分别评价两场赌博时,可能选择 A 和 D;把它们合并后,B+C 却在每个状态都多 10。问题并不是不会算期望值,而是只在局部账户中判断每一次风险,没有整合总财富结果。保险、投资、优惠券和沉没成本题经常使用这一机制。
六、社会偏好与行为博弈论
1. 先掌握标准博弈论基准
纳什均衡的判断标准只有一个:固定其他人的策略,没有任何玩家愿意单方面偏离。不能用“大家都更幸福”或“总收益更高”代替它。序贯博弈则从最后节点开始做逆向归纳。
2. 结果公平:Charness–Rabin 型偏好
以玩家 2 为例,一种分段效用为:
计算前必须先看玩家 2 是领先还是落后,再选择对应分支。社会偏好可能改变最佳反应,从而改变纳什均衡。
3. 结果相同,意图不同
分配偏好只看最终支付;意图与互惠模型还看对方本来可以怎么选。最后都是
七、有限战略推理、受诅咒思维与学习
1. Beauty Contest 不能只做一次直接调整
若比例规则为
理性者的最优选择满足
当
我复习时发现,这里最容易漏掉的是理性玩家之间的反馈:不能只把 20% 的非理性选择直接乘进去,还要让自己的选择重新进入总体平均数。
Level-
例如
2. 信息投射、受诅咒思维与赢家诅咒
在含私人信息的博弈里,行动本身会泄露信号。受诅咒的玩家低估“行动与私人信息之间的相关性”,因此更新不足。一个很短的答题句是:
Actions reveal signals; cursed agents under-update from those actions.
共同价值拍卖中的赢家诅咒来自选择效应:赢标往往意味着自己的估值相对最乐观,因此
理性竞标者必须以“我赢了”为条件重新估值并压低报价,而不能直接按无条件估值出价。
3. 学习不一定收敛到同一个结果
课程比较了强化学习、信念学习和 EWA 等机制。强化学习更依赖已选择行动的实际回报,信念学习会更新对其他人策略的判断,EWA 则试图统一二者。
路径依赖实验进一步说明:微小的初始差异可能通过正反馈把群体推向不同稳定点,例如最终集中在 3 或 12。短期历史并不只是噪声,它可能永久改变长期结果。
八、行为福利经济学:什么时候应该干预
行为政策的核心不是看到偏差就立刻禁止,而是识别内在性(internality):今天的选择给未来自己造成、但今天没有充分计入的成本。
在一个简化模型中,若未来损害为
它不是传统外部性税:受损者与决策者是同一个人的不同时间自我。
政策工具可以按干预强度理解:
- 自由意志家长主义:保留选择自由,例如默认加入但允许退出。
- 非对称家长主义:主要帮助会犯错的人,同时尽量少妨碍理性选择者。
- 稳健家长主义:即使对行为参数估计不精确,也能在较广条件下提高福利。
课程中的工具包括默认选项、主动选择、冷静期、承诺装置、信息披露和持久选择。一个完整政策答案应按“偏差—内在性—工具—福利成本”展开,而不是只说“设置默认项就好”。默认项也可能误导异质人群,税收也可能惩罚本来就理性的人,因此必须讨论误伤与退出成本。
九、最值得放进 Cheat Sheet 的公式与辨析
| 模块 | 最小公式或判断句 | 高频陷阱 |
|---|---|---|
| 贝叶斯 | 后验 = 真阳性 / 全部阳性 | 混淆假阳性与假阴性 |
| 期望效用 | 把期望财富直接代替期望效用 | |
| 前景理论 | 结果相对参照点编码 | 把损失厌恶等同于一般风险厌恶 |
| 现在偏误 | 当期无 |
忘记 naive 与 sophisticated 的预期不同 |
| 投射偏差 | 当前状态污染未来效用预测 | 混淆状态值与状态下的效用 |
| 信息回避 | 比较工具价值与心理成本 | 忘记给好坏消息加概率权重 |
| 纳什均衡 | 固定他人策略,检查单边偏离 | 用帕累托最优代替均衡条件 |
| 社会偏好 | 先判断谁领先,再选分段函数 | 混淆结果公平与意图互惠 |
| Beauty Contest | 同时解 |
忽略理性玩家之间的反馈 |
| 赢家诅咒 | 以“赢标”为条件更新估值 | 按无条件价值直接竞标 |
| 行为政策 | 偏差 → 内在性 → 工具 → 福利 | 只说助推,不讨论异质性和成本 |
还有几类纯计算错误特别值得记录:独立事件的连续概率要相乘,例如两次连续成功是
十、我的完整复习方法:不只追求“看完”,更要追求“能识别”
完整复习可以按知识之间的关联分阶段进行:先覆盖风险、时间偏好、信念与启发式,再处理博弈论和社会偏好,最后完成有限推理、学习、政策分析与模拟题。这样的顺序能让后面的行为模型建立在清晰的标准模型基准之上,也便于在综合题中连接多个模块。
对我最有效的循环是:
- 用一句话说清概念的规范基准与偏离方向。
- 看一个完整例题,观察如何从文字识别模型。
- 不看答案独立做一道同类题。
- 把错误标成“概念识别、公式设定、代数计算、机制表达”四类之一。
- 只针对错误类型再做一道题,而不是从头重读整章。
贝叶斯就是一个典型案例:第一次错在假阳性,画四格表后重测才真正掌握。Beauty Contest 则错在遗漏均衡反馈,重新联立方程后才理解模型。动态一致性的问题不是不会概念,而是定义不够精确;社会偏好题的问题则是没有先检查效用函数分支。把错误归类以后,复习速度明显快于反复看讲义。
安排复习优先级时,我认为可以采用下面的顺序:
- 第一优先:贝叶斯、期望效用、前景理论、
– 、投射偏差、信息回避。 - 第二优先:纳什均衡、逆向归纳、社会偏好、意图、Beauty Contest、Level-
。 - 第三优先:受诅咒思维、赢家诅咒、学习模型、内在性与政策比较。
- 最后补充:实验名称和零散事实;它们应挂在机制上记,而不是孤立背诵。
模拟卷也不能机械当成真实权重。我们手上的 Mock Final 明确比正式考试短,只有两道大题;真正值得迁移的是题型结构:给一个陌生情境,再连续要求计算、解释机制、比较模型并提出政策含义。
考场上我会用三套短模板:
- 理论题:标准模型预测不变;观察到的变化支持某行为机制,因为……
- 计算题:写公式—代入数字—比较候选项—用一句话解释经济含义。
- 政策题:识别偏差—说明内在性—选择工具—讨论福利收益、误伤和退出成本。
十一、学完 ECON3124 后,我真正带走了什么
这门课最有价值的地方,不是提供一张“人类偏差清单”,而是教人以可检验的方式讨论非理性。一个行为解释必须说明基准模型是什么、偏离从哪里进入效用或信念、它会产生什么不同预测,以及实验和现实数据能否区分这些模型。
它也改变了我看待政策的方式。人在某个时刻作出选择,并不保证那个选择代表长期福利;但发现行为偏差,也不自动赋予政策制定者无限干预的权力。好的行为政策需要同时尊重异质性、选择自由和纠错收益。
对复习本身也是如此:真正的进步并不来自“今天看了多少页”,而来自能否在新题里识别机制、写出正确模型、解释结果,并知道自己上一次究竟错在哪里。对我而言,这正是完整复习 ECON3124 后最值得保留下来的经验。
本文根据我修读学期的 ECON3124 讲义、Tutorial、模拟题与个人复习对话整理,公式符号和考核重点可能随学期调整,请以当期课程材料为准。
- 标题: ECON3124 行为经济学学了什么:从核心理论到期末复习的完整笔记
- 作者: AdenXie
- 创建于 : 2026-08-28 20:20:54
- 链接: https://blog.adenxie.com.cn/2026/08/28/2026-08-28-econ3124-behavioural-economics-review/
- 版权声明: 版权所有 © AdenXie,禁止转载。