工企和污染数据是如何匹配的?使用 Stata 完成整个过程

之前给大家分享给工企和专利库、工企和海关数据库的匹配结果,今天再给大家分享一下工企与企业污染库的匹配方法和结果。

  1. 工企和专利库:1998~2014年工企业专利数据匹配结果(更新版,含 gqid 和 zlid 变量)
  2. 工企专利知识宽度:专利质量如何测算?1998~2014 年工企专利知识宽度计算结果
  3. 工企和海关库:2000~2014 年工企和海关匹配数据

相比于工企+专利和工企+海关,今天分享的工企+污染数据匹配是最简单的,原因在于:

  1. 数据量很小;
  2. 匹配方法简单,仅需根据企业名称和组织机构代码匹配。

更多内容欢迎参加明晚 8 点的直播课学习~

本次课程的主要内容包括:

  1. 合并 1998~2013 年的工企数据库;
  2. 处理企业污染库;
  3. 工企与污染库匹配;
  4. 2014 年的数据匹配
  5. 匹配效果:
匹配效果预览

上图的绘图代码:

clear
input 年份 匹配使用的工企库观测值数量 匹配数量
1998 165115 24802
1999 162022 29459
2000 162872 31127
2001 171254 31281
2002 181542 31661
2003 196206 32225
2004 279011 38242
2005 270023 38155
2006 301930 40755
2007 336732 51942
2008 412212 50177
2009 366130 46180
2010 442539 55972
2011 302593 63119
2012 324604 64711
2013 344875 65027
2014 309138 51012
end

gen 匹配率 = round(匹配数量 / 匹配使用的工企库观测值数量 * 100, 0.01)

tw bar 匹配数量 年份, color("102 194 165") barwidth(0.8) || ///
line 匹配率 年份, yaxis(2) color("252 141 98") lw(*2) ///
leg(pos(6) row(1)) ///
yla(12 "12%" 14 "14%" 16 "16%" 18 "18%" 20 "20%" 22 "22%", axis(2)) ///
xti("") xla(1998(2)2014) ///
ti("1998~2014 年工企数据库与企业污染数据库匹配结果") ///
subti("匹配:微信公众号 RStata")

点击这里跳转到 RStata 短书平台获取附件:工企和污染数据是如何匹配的?使用 Stata 完成整个过程

评论