旧版本|1985~2022 年上市公司与绿色专利数据匹配结果(版本2)

之前给大家分享过如何使用 R 语言爬取 WIPO 绿色专利分类号列表、以及如何使用 Stata 进行绿色专利筛选的课程:

×

使用课程中介绍的方法就可以进行绿色专利的筛选了:

最近有培训班的小伙伴提出需要将上市公司和绿色专利数据进行匹配,但是数据量比较大,希望我能帮忙处理一下。上市公司的数据我之前也分享过:

所以今天给大家分享的就是这份上市公司数据和绿色专利数据匹配的结果。

匹配结果

数据的时间范围为 1985~2022 年,绿色专利数据里面有分类号和主分类号两个变量,所以匹配的结果也分为两种:

  1. 根据分类号筛选;
  2. 根据主分类号筛选。

例如根据分类号筛选的 1985~2022 年上市公司与绿色专利数据匹配情况:

专利数据库 2021 和2022 年的数据不全,使用时需要注意。

dta 格式的数据预览如下:

注意事项

在计算上市公司绿色专利申请数量时需要注意,专利数据里面有很多申请和授权同时存在的专利,在统计专利数量的时候应该先去除这种重复情况:

统计的时候可以先去除公开公告号里面的 A、B、U、S。其中 A 代表发明专利的申请公开,B 代表发明专利的授权公告,U 代表实用新型专利的授权公告,S 代表外观设计专利的授权公告。

replace 公开公告号 = subinstr(公开公告号, "A", "", .)
replace 公开公告号 = subinstr(公开公告号, "B", "", .)
replace 公开公告号 = subinstr(公开公告号, "U", "", .)
replace 公开公告号 = subinstr(公开公告号, "S", "", .)
replace 专利类型 = "发明" if index(专利类型, "发明")
*- 使用 duplicates drop 去除重复的
duplicates drop 公开公告号, force

点击这里跳转到 RStata 短书平台获取附件:旧版本|1985~2022 年上市公司与绿色专利数据匹配结果(版本2)

评论