之前给大家分享过 2007~2016 年税调数据与专利数据匹配结果:
2007~2016 年税调数据与专利数据匹配结果:https://rstata.duanshu.com/#/course/3e4b929a19ab4419871e07e470ecc5f6
![]()
最近有小伙伴提出,当年的申请量可能不足以反映企业的创新能力变化,使用每一年的税调数据与本年及未来三年的专利数据进行匹配得到的结果会更全面。
因此这一次我匹配了税调本年及未来三年的专利申请结果。例如 2007 年的税调数据会和 2007~2010 四年的专利数据进行匹配。
匹配结果
数据格式方面,我提供了 dta 格式的 2007~2016 年税调与本年及未来三年的专利数据匹配结果。由于数据非常大,所以我还提供了按年拆分的匹配结果,例如 2007 年税调与本年及未来三年的专利数据匹配结果共 63.5 万条,概览如下:
![]()
无法直接读取完整版的小伙伴可以逐年处理再合并处理结果。另外也可以使用一点点读取的方法,例如读取前 100 行:use in 1/100 using 文件, clear,通常一次读取 100 万行问题不大。
包含的变量如下:
年份、sdid、newzlid、专利年份、公开公告号、专利名称、专利类型、摘要、申请人、申请号、申请日、授权公布号、地址、主权项、发明设计人、分类号、主分类号、专利代理机构、分案原申请号、优先权、国际申请、国际公布、代理人、省份或国家代码、专利领域、专利学科、多次公布、城市、所属国省、公开公告日、省、省代码、市、市代码、县、县代码、纬度、经度、参考文献、代码、发布路径、范畴分类、国别、名称、申请国代码、申请来源、邮编、页数、专利号、颁证日、审查员、进入国家日期、摘要附图存储路径
下图展示了历年税调企业当年、第二年、第三年和第四年的专利申请量:
![]()
注意事项
在计算工企专利申请数量时需要注意,专利数据里面有很多申请和授权同时存在的专利,在统计专利数量的时候应该先去除这种重复情况:
![]()
统计的时候可以先去除公开公告号里面的 A、B、U、S。其中 A 代表发明专利的申请公开,B 代表发明专利的授权公告,U 代表实用新型专利的授权公告,S 代表外观设计专利的授权公告。
*- 统计每年观测值的数量 |
点击这里跳转到 RStata 短书平台获取附件:2007~2016 年税调与本年及未来三年的专利数据匹配结果
评论