【发布时间】:2020-07-02 16:46:19
【问题描述】:
我有以下具有非常大的 N(500,000)和小 T(15 年)的面板数据集。我的因变量是 Project1 或 project 2。我想估计 Project 依赖于年份和村庄固定效应的可能性。对于连续因变量,我使用的是 reghdfe。
因变量很简单,当一个村庄获得该项目时,虚拟变量等于 1,并且在接下来的几年中保持为 1。
我知道我不能在 STATA 中使用“probit”命令,因为我有一个面板。您能建议我应该使用哪种型号吗?
| village | population | year | project_1 | project_2 | treated |
|---------|------------|------|-----------|-----------|-----------|
| A | 100 | 2001 | 0 | 0 | 0 |
| A | 100 | 2002 | 1 | 0 | 0 |
| A | 100 | 2003 | 1 | 0 | 1 |
| A | 100 | 2004 | 1 | 0 | 1 |
| A | 100 | 2005 | 1 | 0 | 1 |
| B | 200 | 2001 | 0 | 0 | 0 |
| B | 200 | 2002 | 0 | 0 | 1 |
| B | 200 | 2003 | 0 | 1 | 1 |
| B | 200 | 2004 | 0 | 1 | 1 |
| B | 200 | 2005 | 0 | 1 | 1 |
| C | 150 | 2001 | 0 | 0 | 0 |
| C | 150 | 2002 | 0 | 0 | 0 |
| C | 150 | 2003 | 0 | 0 | 0 |
| C | 150 | 2004 | 1 | 0 | 0 |
| C | 150 | 2005 | 1 | 0 | 1 |
| D | 175 | 2001 | 0 | 0 | 0 |
| D | 175 | 2002 | 0 | 0 | 0 |
| D | 175 | 2003 | 0 | 0 | 0 |
| D | 175 | 2004 | 0 | 0 | 1 |
| D | 175 | 2005 | 0 | 0 | 1 |
【问题讨论】:
-
关于使用哪种统计方法或模型的问题在 Stack Overflow 上是题外话。这在 Cross Validated 或 Statalist 上会更好。