发明人团队稳定性(发明人集合运算)
「发明人团队稳定性(发明人集合运算)」,覆盖 1991-2025 年,频率 年度,上市公司层级,含 25 个变量,样本量约 49,336。 衡量企业研发团队的稳定性与人员动态。
| 时间跨度 | 1991-2025 年 |
|---|---|
| 数据频率 | 年度 |
| 层级 | 上市公司 |
| 变量数 | 25 |
| 样本量 | 49,336 |
| 是否可合并 | 可与同主体数据集合并 |
字段字典
- Symbol [股票代码] — 股票代码
- StkName [证券简称] — 证券简称
- Year [年份] — 专利申请年度
- Province [省份] — 公司注册所在省份
- ProvinceCode [省份代码] — 省份行政区划代码(6位)
- City [城市] — 公司注册所在城市
- CityCode [城市代码] — 城市行政区划代码(6位)
- County [区县] — 公司注册所在区县
- CountyCode [区县代码] — 区县行政区划代码(6位)
- IndustryCode [行业代码] — 中上协行业分类代码
- IndustryName [行业名称] — 中上协行业分类名称
- PatentCount [专利申请数量] — 当年母公司(是否母公司申请=1)申请的专利总数
- PatentsWithInventor [有发明人信息的专利数] — 当年有发明人署名信息的专利数量。单位:件
- MissingInventorRate [发明人信息缺失率] — 计算公式为:1 - 有发明人信息的专利数 / 总专利数。值越高表示该年度专利中缺少发明人信息的比例越大。单位:比例
- UniqueInventorCount [活跃发明人数] — 当年参与专利申请的不重复发明人数量。单位:人
- RetainedInventorCount [留存发明人数] — 与上一年(仅连续年份)重叠的发明人数量,即集合交集大小。单位:人
- NewInventorCount [新进发明人数] — 今年出现但上一年未出现的发明人数量,即集合差集大小。单位:人
- DepartedInventorCount [流失发明人数] — 上一年出现但今年未出现的发明人数量,即集合差集大小。单位:人
- YearGap [年份间隔] — 与上一个有专利年份的间隔(1=连续年份)。发明人留存率仅在年份间隔=1时有值。单位:%
- InventorRetention [发明人留存率] — 受Bernstein (2015, JF)的发明人stayer/leaver框架启发,计算公式为:当年发明人集合与上年发明人集合的交集大小除以上年发明人集合大小。仅对连续年份(年份间隔=1)计算。用作研究变量,越大代表研发团队人员留存越高。单位:比例
- InventorNewRate [发明人新进率] — 受Bernstein (2015, JF)的方法启发,计算公式为:新进发明人数 / 当年活跃发明人数。仅对连续年份(年份间隔=1)计算。用作研究变量,越大代表研发团队新血液注入越多。单位:比例
- CoreInventorCount [核心发明人数] — 受Zucker & Darby (1998, AER)的star scientist概念和Hoisl (2007, Research Policy)的发明人生产力研究启发,定义为近3年滚动窗口内累计申请3件及以上专利的发明人数量。单位:人
- CoreInventorShare [核心发明人占比] — 受Zucker & Darby (1998, AER)的方法启发,计算公式为:核心发明人数 / 当年活跃发明人数。用作研究变量,越大代表研发团队核心化程度越高。单位:比例
- AvgTeamSize [平均团队规模] — 计算公式为:有发明人信息专利的发明人数之和 / 有发明人信息的专利数。用作研究变量,越大代表专利团队协作规模越大。单位:人
- InventorHHI [发明人集中度] — 计算公式为:各发明人的专利份额(该发明人专利数/所有发明人专利数之和)的平方和(赫芬达尔指数指数)。用作研究变量,越大代表专利创造越集中于少数人
常见问题
- 「发明人团队稳定性(发明人集合运算)」是什么数据集?
- 发明人团队稳定性(发明人集合运算),隶属创新与知识产权。衡量企业研发团队的稳定性与人员动态。
- 该数据集的时间范围是?
- 覆盖 1991-2025 年。
- 包含哪些变量/指标?
- 共 25 个变量。核心指标包括:专利申请数量、有发明人信息的专利数、发明人信息缺失率、活跃发明人数、留存发明人数、新进发明人数、流失发明人数、年份间隔、发明人留存率、发明人新进率、核心发明人数、核心发明人占比、平均团队规模、发明人集中度。完整字段清单(变量名·中文名·说明)见页面「字段字典」。
- 数据频率和层级是怎样的?
- 频率为年度,上市公司层级。
- 样本量有多大?
- 约 49,336 条观测。
- 数据是如何测算/获取的?
- 指标定义与计算方法 本数据集旨在通过分析企业年度专利申请中的发明人署名信息,衡量其研发团队的稳定性、流动性与核心化程度。研发团队的人员构成与动态变化是影响企业创新持续性与质量的关键因素。数据集以公司-年度为观测单元,核心计算基于每年专利申请中出现的发明人集合。基础变量包括当年专利申请总数、有发明人信息的专利数、以及当年活跃的不重复发明人总数。其中,发明人信息缺失率($MissingInventorRate$)反映了数据完整性,计算公式为 $1 - PatentsWithInventor / PatentCount$。 团队动态的核心衡量围绕发明人集合的跨年变化展开。对于连续两年(即$YearGap=1$)均有专利申请的公司,通过比较当年发明人集合($It$)与上一年集合($I{t-1}$),计算留存发明人数($|It \cap I{t-1}|$)、新进发明人数($|It - I{t-1}|$)和流失发明人数($|I{t-1} - It|$)。在此基础上,构建两个关键比率:发明人留存率($InventorRetention$)和发明人新进率($InventorNewRate$),分别反映团队的稳定性和新鲜血液的注入程度。其计算公式分别为: $$InventorRetention = \frac{|It \cap I{t-1}|}{|I{t-1}|}$$ $$InventorNewRate = \frac{NewInventorCount}{|It|}$$ 其中$|It|$为当年活跃发明人数($UniqueInventorCount$),$|I{t-1}|$为上一年活跃发明人数。 团队结构的衡量包括集中度与核心化程度。发明人集中度($InventorHHI$)采用赫芬达尔指数,计算各发明人当年专利申请数占公司当年总申请数份额的平方和,值越高表明专利产出越集中于少数发明人。平均团队规模($AvgTeamSize$)为有发明人信息的专利的平均署名人数,计算公式为 $有发明人专利的发明人数之和 / PatentsWithInventor$。核心发明人的识别借鉴了“明星科学家”的概念,定义为在近三年滚动窗口内累计申请专利数达到3件及以上的发明人。核心发明人数($CoreInventorCount$)及其在活跃发明人中的占比($CoreInventorShare$)共同刻画了研发团队的核心化程度,$CoreInventorShare$的计算公式为 $CoreInventorCount / UniqueInventorCount$。 补充说明 - 发明人留存率($InventorRetention$)与发明人新进率($InventorNewRate$)仅在连续年份($YearGap=1$)有专利申请时进行计算,否则为缺失值。 - 核心发明人($CoreInventor$)的判定基于一个滚动的三年窗口([t-2, t]),要求发明人在此窗口期内累计专利申请数不少于3件。 参考文献 - Bernstein S. Does going public affect innovation?[J]. The Journal of Finance, 2015, 70(4): 1365-1403. - Hoisl K. Tracing mobile inventors—the causality between inventor mobility and inventor productivity[J]. Research Policy, 2007, 36(5): 619-636. - Zucker L G, Darby M R. Capturing technological opportunity via Japan's star scientists: evidence from Japanese firms' biotech patents and products[J]. The Journal of Technology Transfer, 2001, 26(1): 37-58.
- 如何获取该数据集?
- 通过站内对应淘宝链接下单后,客服发放兑换码;在站内"兑换"页输入兑换码即可获得下载权益并下载。