2007~2016 年税调企业与数字经济专利匹配结果

最近给大家更新了税调企业与专利数据的匹配结果:

2007~2016 年税调数据与专利数据匹配结果(版本3):https://rstata.duanshu.com/#/course/92e1ec40fa214f308598a661469e069e

也给大家更新了数字经济产业相关专利的筛选结果:

1985~2024 年数字经济产业相关专利筛选结果:https://rstata.duanshu.com/#/course/d5dfb9ca0858457ebc4f176fce9fee80

将上面的两份数据进行匹配,就可以得到税调企业与数字经济产业相关专利的匹配结果了。

匹配结果

为了避免数据过于庞大的问题,我使用了四组文件存放这份数据。

第一组是税调企业与数字经济专利数据匹配结果,按年拆分。以 2016 年为例,数据预览如下:

其中 newzlid 变量是我给专利的编号,每个 newzlid 对应一个专利,包含 newzlid 变量的数据可以直接和这个数据使用该变量匹配;纬度、经度是根据申请人地址解析得到的;省、省代码、市、市代码、县、县代码是根据经纬度和 2021 年行政区划判断得到。

第二组是基于主分类号筛选的数字经济专利 newzlid 变量和 数字经济产业分类ID 的对照表:

第三组是每个 数据经济产业分类ID 的具体含义:

  • 数字经济核心产业分类与国际专利分类参照关系表.dta

第四组是 2007~2016 年税调企业数字经济专利申请与授权数量统计:

下图更直观地展示了历年各税调企业数字经济专利申请与授权量变化:

注意事项

在计算专利申请数量时需要注意,专利数据里面有很多申请和授权同时存在的专利,在统计专利数量的时候应该先去除这种重复情况:

统计的时候可以先去除公开公告号里面的 A、B、U、S。其中 A 代表发明专利的申请公开,B 代表发明专利的授权公告,U 代表实用新型专利的授权公告,S 代表外观设计专利的授权公告。

replace 公开公告号 = subinstr(公开公告号, "A", "", .)
replace 公开公告号 = subinstr(公开公告号, "B", "", .)
replace 公开公告号 = subinstr(公开公告号, "U", "", .)
replace 公开公告号 = subinstr(公开公告号, "S", "", .)
replace 专利类型 = "发明" if index(专利类型, "发明")
*- 使用 duplicates drop 去除重复的
duplicates drop 公开公告号, force

点击这里跳转到 RStata 短书平台获取附件:旧版本|2007~2016 年税调企业与数字经济专利匹配结果

评论