之前一段时间给大家分享了一大堆专利相关的匹配结果数据,今天给大家分享一份瞪羚企业、独角兽和科技型初创企业数据和专利数据库匹配结果数据。使用的瞪羚企业、独角兽和科技型初创企业数据就是前几天分享的:中国瞪羚企业、独角兽和科技型初创企业名录数据(含基本信息和注册地址经纬度)
另外关于专利数据匹配的结果有下面这些:
- 工企 + 专利(1998~2014)
- 工企 + 专利 + 专利知识宽度(1998~2014)
- 工企 + 海关 + 专利(2000~2014)
- 工企 + 污染 + 专利(1998~2014)
- 上市公司 + 专利(1992~2019)
匹配方法是使用瞪羚企业、独角兽和科技型初创企业的公司名称和专利数据库中的申请人变量进行匹配,由于每个专利对应的申请人有多个,所以同一个专利可能会匹配到多个公司。由于专利数据暂时不便提供,所以附件中提供的 Stata 匹配代码仅供参考。
瞪羚企业、独角兽和科技型初创企业和专利数据匹配结果的时间范围 1992~2019 年,不过由于使用的专利数据库中的 2017~2019 年数据不全,所以匹配结果的 2017~2019 年数据也是不全的。建议使用 1992~2016 年部分的,各年匹配到的专利数量如下:
| 瞪羚企业、独角兽和科技型初创企业数据与专利数据库匹配结果概览 |
|---|
![]() |
作为对比,上表和图中还展示了国泰安提供的上市公司和专利数据匹配结果,可以看出,我们匹配的结果中包含了更多的专利,比国泰安的数据更全一些。
提供的数据包含两种格式:
- 瞪羚企业、独角兽和科技型初创企业数据与专利数据库匹配结果.dta
- 瞪羚企业、独角兽和科技型初创企业数据与专利数据库匹配结果.xlsx
包含如下变量:
年份, zlid, 企业名称, 成立时间, 注销时间, ID, 国家, 省份, 城市, 区县, 是否上市, 是否高新企业, 最新认证, 历史认证, 所在高新区, 级别, 地域, 所属领域, 领域, 所属行业, 认证年份, 认证类型, 认证类型_简化, 经营状态, 历史名称, 标签, 地址, 电话, 官网, 行业, 邮箱, 园区, 经度, 纬度, 申请日, 分类号, 主分类号, 公开公告日, 申请人, 参考文献, 代理人, 代码, 分案原申请号, 发布路径, 范畴分类, 发明设计人, 国别, 公开公告号, 名称, 申请国代码, 申请号, 申请来源, 邮编, 页数, 优先权, 专利代理机构, 专利号, 专利类型, 主权项, 摘要, 颁证日, 审查员, 国际公布, 国际申请, 进入国家日期, 摘要附图存储路径
预览如下:
| 数据预览 |
|---|
![]() |
如何根据匹配结果统计每个公司各种类型专利的数量并生成平衡面板?
可以使用下面的 Stata 代码来实现:
* 统计每个公司的各种类型专利数量 |
最后汇总下本次分享的数据和代码:
- 瞪羚企业、独角兽和科技型初创企业数据与专利数据库匹配结果.dta
- 瞪羚企业、独角兽和科技型初创企业数据与专利数据库匹配结果.xlsx
- 瞪羚企业、独角兽和科技型初创企业专利申请数量面板数据(1985~2019).dta
- 瞪羚企业名录(基本信息+经纬度).dta
- 相关 Stata 匹配代码(不含专利数据)
点击这里跳转到 RStata 短书平台获取附件:旧版本|瞪羚企业、独角兽和科技型初创企业数据与专利数据库匹配结果(1985~2019年)


评论