python 双重差分模型_双重差分模型DID python操作

最新推荐文章于 2022-04-30 16:48:02 发布

薿瑊珩翯

最新推荐文章于 2022-04-30 16:48:02 发布

阅读量4.2k

点赞数

文章标签： python 双重差分模型

本文链接：https://blog.csdn.net/weixin_29282577/article/details/114396271

版权

本文详细介绍了双重差分模型(Difference-in-Differences, DID)在政策评估中的应用，包括传统DID、经典DID、异时DID、广义DID和异质性DID等五种形式。DID方法通过处理组和控制组的差异来估计政策效应。文章还提供了Stata中DID模型的实际操作示例，涉及模型设定、异质性处理效应和平行趋势检验等内容。" 94889191,7479400,洛谷P1262：间谍网络与强连通分量,"['图论算法', '数据结构', '题目解析', '洛谷竞赛', '图的遍历']

摘要由CSDN通过智能技术生成

搬运网站：https://blog.csdn.net/Claire_chen_jia/article/details/106903842?utm_medium=distribute.pc_aggpage_search_result.none-task-blog-2~all~top_click~default-1-106903842.nonecase

双重差分模型DID学习

双重差分模型 (Difference-Differences, DID)是政策评估的非实验方法中最为常用的一种方法，其中交互项是DID的灵魂。

交互项形式拥有各种形式，包括(1)传统DID；(2)经典DID；(3)异时DID；(4)广义DID；以及(5)异质性DID。下面分别介绍这几种。

双重差分法是研究“处理效应”(treatment effects)的流行方法。一般来说，DID的使用场景为，在面板数据中，个体可分为两类，即受到政策冲击的“处理组”(treatment group)与未受政策影响的“控制组”(control group)。重点落在政策冲击和是否受到政策冲击，通过引入虚拟变量来实现。即：

政策冲击前后(pre-post)设为0和1，是否受到政策冲击(control-treat)设为0和1.

ba6297e7d964

因而，模型常设计为

ba6297e7d964

处理组虚拟变量 beta 捕捉了处理组的组别效应(处理组与控制组的固有差别)，处理期虚拟变量lambda控制了处理期的时间效应(处理期前后的固有时间趋势)， X为其他控制变量，而交互项xigema 则代表了处理组在处理期的真正效应(受到政策冲击的效应)，这正是我们关心的处理效应。然后进行OLS估计即可。

经典DID是在传统DID模型上控制了个体固定效应(individual fixed effects)和时间固定效应(time fixed effects)，并去除单独变量。模型如下：

ba6297e7d964

模型解释如下：

(1)u 为个体固定效应。加入个体固定效应之后，就不必再放入处理组虚拟变量(treat i)，否则会引起多重共线性问题。因为前者包含比后者更多的信息(前者控制到个体层面，而后者仅控制到组别层面)。

(2)入为时间固定效应。同理，加入时间固定效应就不用再加处理期虚拟变量(post t)。否则，将导致严格多重共线性，因为前者包含比后者更多的信息(前者控制了每一期的时间效应，而后者仅控制处理期前后的时间效应)

(3)注意：估计方法依然是OLS，但须使用“聚类稳健标准误”(cluster-robust standard errors)。

在传统与经典DID的模型设定中，一个隐含假设是，处理组的所有个体开始受到政策冲击的时间均完全相同。但有时也会遇到每位个体的处理期不完全一致的情形(heterogeneous timing)；比如，某项试点政策在不同城市分批推出。此时，可使用“异时DID”(heterogeneous timing DID)。

异时DID的关键在于，既然每位个体的处理期不完全一致，则处理期虚拟变量也因个体而异，故应写为post(i,t)，既依赖于个体 i，也依赖于时间 t。模型设定为如下任意一种形式：

ba6297e7d964

举一个5期面板数据在stata的应用：

1)定义变量：定义因个体而异的处理期虚拟变量post(i,t)；

2)识别受影响：post1(i,t) = (0,0，1，1,1)代表第1位个体从第3期开始受到政策处理；post2(i,t) = (0,0，0，1,1)代表第2位个体从第4期开始受到政策处理；post3(i,t) = (0,0，0，0,0)代表从未受到政策冲击(属于控制组)。

以上各种DID方法均假设存在处理组与控制组的区别，但有时某项政策在全国统一铺开，此时只有处理组，并没有控制组，是否还能使用DID呢？答案是“能”，可以尝试“广义DID”(generalized DID)。

使用广义DID的重要前提是，虽然所有个体均同时受到政策冲击，但政策对于每位个体的影响力度并不相同，不妨以 intensity(i) 来表示。

ba6297e7d964

其中，交互项系数为我们关注的对象。此外对于广义DID，文献中也有门槛区分组别的方法，即人为地设定一个门槛值 c，根据变量是否超过此门槛值来定义处理组与控制组。因为将连续变量压缩为二分变量损失了不少信息，故在实践中已不多见。

ba6297e7d964

传统的处理效应模型一般假设“同质性处理效应”(homogeneous treatment effects)，即所有个体的处理效应都相同。显然，此假定太苛刻，在实践中难以成立。更为合理的假定则为“异质性处理效应”(heterogeneous treatment effects)，即允许每位个体的处理效应不尽相同。具体而言&#x