上次给大家分享了 1998~2024 的专利申请和授权信息:
1985~2024 年专利申请与授权数据(版本 3,含申请人所处的省市区县):https://rstata.duanshu.com/#/brief/course/2397451274c546d3a36e156ffc865988
以及详细的引用与被引用信息:
1998~2024 的专利引用与被引用信息及次数统计:https://rstata.duanshu.com/#/brief/course/de4968acb01047b3801c200e9cf7ed41
然后又根据国家知识产权局提供的绿色专利筛选标准筛选了一份绿色专利数据:
1985~2024 年绿色专利申请与授权数据(国家知识产权局标准):https://rstata.duanshu.com/#/brief/course/9cfa513db3a54891bef466caac9e6a62
需要注意今天分享的数据不包含专利的基本信息,需要结合两个数据一起使用。
今天给大家分享一份绿色专利的引用与被引用信息,也就是把上面的两份数据匹配起来的结果:
![]()
该数据包含如下变量:
newipzlid、年份、公开公告号、公开公告日、引证专利、被引证专利、自引信息、他引信息、被自引信息、被他引信息、家族引证、家族被引证、引证申请人、被引证申请人、家族引证申请人、家族被引证申请人、引证次数、被引证次数、自引次数、他引次数、被自引次数、被他引次数、家族引证次数、家族被引证次数、引证科技文献、引证类别、被引证类别、引证来源、被引证来源、被引证国别_forward、技术分支编号
该数据和上面提到的数据里面都包含 newipzlid 变量,也就是观测值编号,相关数据可以使用该变量匹配起来使用。
技术分支编号 变量是指绿色专利技术分支编号,附件中还提供了一份数据:
- 绿色专利分类号筛选标准.dta
![]()
专利数据匹配与提取服务
由于专利数据非常巨大,难以匹配和使用,因此特推出专利数据匹配服务,费用大致如下:
该服务仅面向 RStata 会员;
- 每 10 万个公司名称匹配收费 300 元,低于 10 万个公司名称也是 300 元(300 元起步);
- 专利知识宽度计算:每 10 万个公司名称收费 100 元,低于 10 万个公司名称也是 100 元(100 元起步);
- 绿色专利筛选:每 10 万个公司名称收费 100 元,低于 10 万个公司名称也是 100 元(100 元起步);
- 注意这里的数量是指匹配使用的数量,而非匹配成功的数量;
- 其他类似的操作 ……
另外该份专利数据实际上还包含很多变量,完整的数据大小超过 2TB,所以这里我仅仅选择了部分变量进行分享,如果需要其他变量的,可以联系李老师获取完整变量列表及帮忙提取所需变量,费用也是 300 元/次。
虽然不限制数量,不过变量数量过多也会导致数据变得非常大而难以处理,所以还是仅仅选择自己需要的变量就好。
点击这里跳转到 RStata 短书平台获取附件:1998~2024 年绿色专利引用与被引用信息及次数统计(国家知识产权局筛选标准)
评论