前言
译注:原著是 Peng Ding 的《A First Course in Causal Inference》。译文想尽量像一位愿意陪你慢慢想明白的朋友在说话——因果这件事,本来就关乎我们如何温柔、认真地理解世界。
过去十年:因果推断的研究与教育
过去十年,人们对因果推断突然热情起来。生物医学、社会科学、科技公司……许多地方都需要它。可即便十年前,当我还是统计系博士生时,光景完全不同。那时它还不是主流,开这门课的学校很少。学界里,不少人对它的根基仍抱着迟疑——它带来的那些概念困难,和我们习惯的数理统计训练,真的不太一样。
后来,经验研究里对「究竟是什么在起作用」的追问,慢慢改变了统计学的面貌。说到底,统计学不只是纸上的理论,也是帮我们理解真实生活的工具。许多优秀的研究者加入进来;许多学生也渴望学会这些方法,好更从容地面对各自领域里的问题。
正是学生的需要,让同事们鼓励我开一门因果推断课。起初,我教的是政治学与统计学交叉列出的研究生课——我从前的同事 Jas Sekhon 在伯克利教了许多年。再后来,我把它同时面向本科生与研究生。课号是 Stat 156 和 Stat 256。两班学生听同一堂课、用同一套讲义;作业、阅读和期末项目则按程度分开。
学生的准备程度参差不齐,教学里最让我费心的,是两边都照顾到。我希望写得够直觉,本科生只要有概率、统计、线性回归和逻辑回归的基础就能跟;同时,也想把较新的研究带给研究生。这本书,是我过去七年在这中间慢慢磨出来的。
给授课教师的建议
全书正文二十九章,附录三章。伯克利一学期大约十四周,三十二章我讲不完。下面这些,是我自己教下来的一点经验,供你参考。
附录
我通常从正文讲起,但会请助教帮学生复习附录 A、B。学期初也会从附录 A–C 布置几道作业,轻轻推大家先把基础温一温。
第一部分
第 1 章的核心是尤尔–辛普森悖论。第 2 章引入潜在结果——那是全书真正站稳的地方。
第二部分
随机化实验这一部分,教师们的安排可以很不一样。我和许多朋友聊过现在这样写的利弊。随机化能消掉未观测混杂,所以实验里的因果相对好懂;有朋友觉得第 3–9 章对初学者偏长——我也确实用一个月讲实验,让一些学生觉得太慢。可我是读着 Imbens and Rubin (2015) 长大的,总觉得要走进观察性研究,最好先把随机化实验摸熟。我也一直很喜欢 Neyman (1923) 和 Fisher (1935) 那些经典工作。所以第二部分其实带着我自己的学术脾气。若你不想花一个月,第 5、7、8、9 章可以带得快一些。
第三部分
第三部分谈「没有未观测混杂」时的观察性研究。四根支柱——结果回归、逆倾向得分加权、双重稳健估计、匹配——分别在第 10、11、12、15 章。第 13、14 章可选;但里面并不枯燥,我有时会挑一两处讲,让助教在实验课里多带一点,也用作业鼓励学生自己读。
第四部分
第四部分试着用一种较新的方式,面对观察性研究里最难的部分:未观测混杂与重叠。问题本身细而绕,这一部分远谈不上圆满。第 17、18、20 章是核心;第 16、19 章可选。
第五部分
第五部分谈工具变量。第 21、23、24 章比较关键;第 22、25 章可选。
第六部分
第六部分是一些专题,大体都可选。Baron–Kenny 方法在中介分析里很常见,第 27 章或许值得花一点时间。
未覆盖的主题
双重差分、面板数据、合成控制这些流行的计量方法,本书没有系统展开,可参考 Angrist and Pischke (2008)。本书尽量不假设你已有很深的概率与统计背景。入门课多半用频率派视角(未知参数看作固定的),本书也沿用这个视角,并暂且放下贝叶斯叙事——尽管因果推断里许多根本想法,其实从 Rubin (1978) 起就带着贝叶斯的气息。若你对贝叶斯因果推断感兴趣,可以看看 Li et al. (2023) 的综述。
助教的帮助
在伯克利,助教们帮了我很多。我讲不完的细节,常常是他们在实验课里,耐心地补给学生。
部分作业解答
多数理论题我已写好解答。如果你正在教因果推断课,欢迎写信给我,并告诉我一点课程信息,我可以把解答寄给你。
给读者与学生的额外建议
上面给教师的建议,你也可以先翻一翻。另外还有两件小事。
作业题
每章都有作业。想把理解真正留下来,最好亲手做几道。有些题本身就藏着有用的理论——哪怕暂时推不完,至少把题目读一遍,也常常会有收获。
推荐阅读
每章末有推荐阅读。若你将来想做这方面的研究,这些论文能帮你看见更开阔的风景。我教研究生课时,会从第一周到学期末,每周布置下面这些:
- Bickel et al. (1975)
- Holland (1986)
- Miratrix et al. (2013)
- Lin (2013)
- Li et al. (2018b)
- Rosenbaum and Rubin (1983b)
- Lunceford and Davidian (2004)
- Ding and VanderWeele (2016)
- Pearl (1995)
- Angrist et al. (1996)
- Imbens (2014)
- Frangakis and Rubin (2002)
许多学生后来告诉我,读这些论文的感觉很好。即便你不读这本书,我也真心推荐它们。
本书的特点
过去十年,已经有许多优秀的因果推断书。有些深深影响了我。大学时,我在网上读到 Imbens and Rubin (2015) 的草稿章节——它们轻轻却彻底地改变了我对统计的想象,也把我的心推向了因果推断。Angrist and Pischke (2008) 我读了许多遍,每回重读都像遇见一位老朋友。Rosenbaum (2002b)、Morgan and Winship (2015)、Hernán and Robins (2020) 也是很好的书。我准备本书时,又遇见 Cunningham (2021)、Huntington-Klein (2022)、Brumback (2022)、Huber (2023) 这些新作。
在伯克利教下来,这本书渐渐有了这些特点,或许你会喜欢:
- 尽量好亲近:附录会复习概率与统计基础,不默认你已经是老手。
- 多听听不同领域的声音:统计学、生物统计、计量经济学,以及各种应用。
- 用 R 把想法摸一摸:代码与数据公开在 Harvard Dataverse:https://doi.org/10.7910/DVN/ZX3VEV
- 可以当教材用:有作业,适合本科与研究生;教师也可向我索取部分解答。
致谢
北京大学的耿直教授,在我大学时代把我领进了这个领域。Luke Miratrix、Tirthankar Dasgupta 与 Don Rubin 教授在哈佛统计系担任我的博士论文委员会成员。Tyler VanderWeele 教授在我于哈佛陈曾熙公共卫生学院做博士后时指导我。
伯克利统计系的同事们,给了我一个既认真又温暖的研究环境。Bin Yu 与 Jas Sekhon 从我还是初级教师时起就一直支持我。系主任 Deb Nolan、Sandrine Dudoit 与 Haiyan Huang 鼓励我开这门课。对我来说,这是一段很值得珍惜的经历。
我有幸与许多合作者一起工作,尤其是 Avi Feller、Laura Forastiere、Zhichao Jiang、Fang Han、Fan Li、Xinran Li、Alessandra Mattei、Fabrizia Mealli、Shu Yang 与 Anqi Zhao。书中写下的许多东西,都来自我向他们学到的。
许多伯克利学生对早期讲义提出了真诚而有益的意见。助教 Emily Flanagan 与 Sizhu Lu 仔细读过早期书稿,帮我改得更好。
Joe Blitzstein 教授认真读过早期版本,给了许多细致的意见;回应那些意见,让这本书柔软而显著地进步了。Hongyuan Cao 与 Zhichao Jiang 教授用早期版本开过课,也提出了很宝贵的建议。
我也非常感谢 Young Woong Min、Fangzhou Su、Chaoran Yu 与 Lo-Hua Yuan。
若你发现任何错误,欢迎写信告诉我——我会很感激。