位于两个相邻省份的税调企业经营环境大致相同,但是由于处于不同的省份境内,又可能受到不同的政策环境影响,因此以相邻省份的共同边界为界,可以构造很好的地理断点回归模型。 为了让大家能够更便捷的应用这种模型,我们特意为大家准备了这份“相邻省份对税调企业距离共同边界距离数据(RDD模型数据包)”。非常适合进行省份级别政策的效应评估。
首先我们找到了中国所有的相邻省份对(基于 2019 年中国省级行政区划),一共是 70 组:
附件中的 2019年中国相邻省对.xlsx 文件。
readxl::read_xlsx("2019年中国相邻省对.xlsx") |
之前我们分享过 2007~2016 年税调企业地理位置数据,可以从这里下载:https://rstata.duanshu.com/#/course/76d38022cd004b09b2aa09647936beb0。通过提取每个相邻省份对的税调企业数据并计算每个税调企业距离共同边界的距离就可以得到这个数据包了,例如河南省-山东省的:
![]()
再例如辽宁省-内蒙古自治区的:
![]()
图中的散点表示税调企业,散点越小表示距离共同边界越近。
为了方便大家使用,我们将每个省份对的数据分别存放:
![]()
一共 70 个文件夹(部分相邻省份对没有税调企业被删除了),每个文件夹包含如下内容:
绘图代码.R
税调距离共同边界距离数据.dta
line-shp(文件夹)
shp(文件夹)

其中 税调距离共同边界距离数据.dta 是供 Stata 读取的,里面包含了这两个省份的税调数据及其距离共同边界的距离(里面有 sdid 变量,可以和从 https://rstata.duanshu.com/#/course/76d38022cd004b09b2aa09647936beb0 下载的数据进行匹配得到含全部变量的税调数据)。
数据中的距离单位是 km。
![]()
绘图代码.R 文件是用来绘图的,不过绘图前需要把 song.otf 文件移到工作目录下:
library(tidyverse) |
另外考虑到很多小伙伴可能不会 R 语言,所以我还把绘图数据保存成了 shp 格式的,使用类似下面的绘图语句就可以绘制了:
*- 生成 Stata 图表 |
希望这份数据包能够帮助大家发论文~
建议
为了建立更好的模型,给大家提供如下建议:
- 仅仅把共同省界附近的税调企业纳入到模型中(例如剔除掉距离大于 50km 的,这样也可以减少同一家税调企业在模型中被多次使用);
- 剔除掉含税调企业过少的相邻省份对(例如小于 5 个的),过少的样本缺少代表性。
点击这里跳转到 RStata 短书平台获取附件:相邻省份对的税调与共同边界距离数据 (地理断点回归模型数据包)
评论