之前给大家分享给工企和专利库、工企和海关数据库的匹配结果,今天再给大家分享一下工企与企业污染库的匹配方法和结果。
- 工企和专利库:1998~2014年工企业专利数据匹配结果(更新版,含 gqid 和 zlid 变量)
- 工企专利知识宽度:专利质量如何测算?1998~2014 年工企专利知识宽度计算结果
- 工企和海关库:2000~2014 年工企和海关匹配数据
相比于工企+专利和工企+海关,今天分享的工企+污染数据匹配是最简单的,原因在于:
- 数据量很小;
- 匹配方法简单,仅需根据企业名称和组织机构代码匹配。
更多内容欢迎参加明晚 8 点的直播课学习~
本次课程的主要内容包括:
- 合并 1998~2013 年的工企数据库;
- 处理企业污染库;
- 工企与污染库匹配;
- 2014 年的数据匹配
- 匹配效果:
| 匹配效果预览 |
 |
上图的绘图代码:
clear input 年份 匹配使用的工企库观测值数量 匹配数量 1998 165115 24802 1999 162022 29459 2000 162872 31127 2001 171254 31281 2002 181542 31661 2003 196206 32225 2004 279011 38242 2005 270023 38155 2006 301930 40755 2007 336732 51942 2008 412212 50177 2009 366130 46180 2010 442539 55972 2011 302593 63119 2012 324604 64711 2013 344875 65027 2014 309138 51012 end
gen 匹配率 = round(匹配数量 / 匹配使用的工企库观测值数量 * 100, 0.01)
tw bar 匹配数量 年份, color("102 194 165") barwidth(0.8) || line 匹配率 年份, yaxis(2) color("252 141 98") lw(*2) leg(pos(6) row(1)) yla(12 "12%" 14 "14%" 16 "16%" 18 "18%" 20 "20%" 22 "22%", axis(2)) xti("") xla(1998(2)2014) ti("1998~2014 年工企数据库与企业污染数据库匹配结果") subti("匹配:微信公众号 RStata")
|
点击这里跳转到 RStata 短书平台获取附件:工企和污染数据是如何匹配的?使用 Stata 完成整个过程
评论