【发布时间】:2020-03-21 06:30:48
【问题描述】:
我有一个包含公司信息的数据集:
clear
input firm_id str6 industry int fyear int
1084 7372 2010
1084 7375 2010
1084 7372 2011
1084 7375 2011
1084 7372 2012
1084 7375 2012
1084 7372 2013
1084 7375 2013
1084 7372 2014
1084 7375 2014
1094 2865 2002
1094 2879 2002
1094 5122 2002
1094 5169 2002
1094 2865 2003
1094 2879 2003
1094 5122 2003
1094 5169 2003
1094 2865 2004
1094 2879 2004
1094 5122 2004
1094 5169 2004
1094 2865 2005
1094 2879 2005
1094 5122 2005
1094 5169 2005
1094 2865 2006
1094 2879 2006
1094 5122 2006
1094 5169 2006
1094 2865 2007
1094 2879 2007
1094 5169 2007
1094 2865 2008
1094 2879 2008
end
除了firm_id,它还包括公司在特定年份活跃的行业的信息。
我怎样才能知道公司在某一年离开和进入了多少行业?
我知道我可以通过编写一个“循环中的循环”来查看每个单独的观察结果并检查year+1 是否存在相同的firm_id 和industry 组合来做到这一点。但是我的数据集很大,效率极低。
我也考虑过使用reshape wide 的解决方案,但也找不到解决我的问题的方法(当然,这会产生大量变量,而且效率也不高)。
【问题讨论】:
标签: time-series stata panel-data