中国科学院资源环境科学与数据中心(http://www.resdc.cn/DOI/DOI.aspx?DOIid=32) 上面提供了一份中国人口空间分布公里网格数据集,共六个年份的数据,1990,1995,2000,2005,2010, 2015。虽然该网站提供免费的数据下载(注册登陆即可下载),不过直接下载到的是栅格数据,可能不是很容易使用。为此我把数据下载下来进行了分省、分市和分县的裁剪和统计,得到了三份面板格式的中国人口空间分布面板数据:
- 中国人口空间分布省级面板数据
- 中国人口空间分布市级面板数据
- 中国人口空间分布县级面板数据
原始数据是栅格数据,每个像元表示一个 的区域,我提供的 3 份面板数据包含如下变量
- 年份”
- 省代码
- 省
- 市代码
- 市
- 县代码
- 县
- 均值
- 总和
- 标准差
- 最小值
- 最大值
- 非零像元数
- 非缺失像元数
这里面的变量含义大致如下:
- 均值等:每个省/市/县包含的所有像元值的平均,其余的几个统计量类似;
- 非零像元数:每个省/市/县包含的所有像元值中不等于 0 的像元数量;
- 非缺失像元数:每个省/市/县包含的所有像元值中不是缺失值的像元数量;
数据格式方面我提供下面两种格式:
- 供 Excel 使用的 xlsx 格式的数据;
- 供 Stata 读取的 dta 格式的数据。
其中 Stata 格式的县级数据预览如下:
![]()
为了让大家更加直观的感受这份数据,我绘制了三幅地图展示:
![]()
![]()
![]()
最后这份数据的原始数据是这样的:
![]()
注意事项
- 数据的裁剪使用的是 2019 年中国省市县行政区划,该矢量数据来源于微信公众号“数读城事”;
- 该数据里面的均值变量表示每个省/市/县包含的所有像元值的平均,单位是“人数/平方公里”,原始的栅格数据的分辨率市 1 平方公里,所以每个像元值表示该像元内的人口数。
- 上面的省市县预览图是使用 R 语言绘制的。
- 该数据的处理方法类似之前的夜间灯光数据的处理,感兴趣的小伙伴可以学习:
![]()
点击这里跳转到 RStata 短书平台获取附件:中国各省/市/县人口密度面板数据 (1995~2015年)
评论