1998~2014 年工企与WIPO绿色专利数据匹配结果(版本3)

前不久给大家更新了一份绿色专利数据:

1985~2024 年绿色专利申请与授权数据(WIPO标准):https://rstata.duanshu.com/#/course/e2fbfb44b58b4d48a1cf7ba202587bac

最近有培训班的小伙伴提出需要将工企和更新版的绿色专利数据进行匹配,但是数据量比较大,希望我能帮忙处理一下。工企的数据我之前也分享过:

1998~2015年工企数据库(dta 格式):https://rstata.duanshu.com/#/course/68abc981fa964653848961c16ccb3575

今天给大家分享的就是这份工企数据和绿色专利数据匹配的结果。

数据概览

为了方便大家使用,我使用了三份文件存放这份数据。

第一份数据是工企与绿色专利数据的匹配结果:

  • 1998~2014年工企与WIPO绿色专利数据匹配结果.dta

第二份数据是对第一组数据的汇总和统计,需要注意统计专利数量的时候要去除重复的,具体可以参考下文的注意事项:

  • 1998~2014年工企WIPO绿色专利申请与授权数量统计.dta

第三份数据是绿色专利分类:

  • WIPO绿色专利分类.dta

下图展示了历年各工企绿色专利申请与授权量变化:

注意事项

在计算工企绿色专利申请数量时需要注意,专利数据里面有很多申请和授权同时存在的专利,在统计专利数量的时候应该先去除这种重复情况:

统计的时候可以先去除公开公告号里面的 A、B、U、S。其中 A 代表发明专利的申请公开,B 代表发明专利的授权公告,U 代表实用新型专利的授权公告,S 代表外观设计专利的授权公告。

replace 公开公告号 = subinstr(公开公告号, "A", "", .)
replace 公开公告号 = subinstr(公开公告号, "B", "", .)
replace 公开公告号 = subinstr(公开公告号, "U", "", .)
replace 公开公告号 = subinstr(公开公告号, "S", "", .)
replace 专利类型 = "发明" if index(专利类型, "发明")
*- 使用 duplicates drop 去除重复的
duplicates drop 公开公告号, force

数据引用格式

在论文中使用该数据请声明数据来源于RStata 数据中心,或者 RStata Data Center,并使用下述的格式引用:

RStata 数据中心: 1998~2014 年工企与WIPO绿色专利数据匹配结果(版本3). 2025. https://tidyfriday.cn/rsdb2/

RStata Data Center: Matching Results of Industrial Enterprises and WIPO Green Patent Data from 1998 to 2014 (Version 3). 2025. https://tidyfriday.cn/rsdb2/

另外也建议在说明数据来源的同时,根据本文的介绍在论文中描述数据的详细处理方法。

点击这里跳转到 RStata 短书平台获取附件:1998~2014 年工企与WIPO绿色专利数据匹配结果(版本3)

评论