产品定制能力(MD&A关键词熵)

「产品定制能力(MD&A关键词熵)」,覆盖 1991-2025 年,频率 年度,上市公司层级,含 14 个变量,样本量约 67,320。 衡量企业根据客户需求进行产品定制的能力。

时间跨度1991-2025 年
数据频率年度
层级上市公司
变量数14
样本量67,320
是否可合并可与同主体数据集合并

字段字典

  • Symbol [股票代码] — 6位股票代码
  • StkName [证券简称] — 证券简称
  • Year [年份] — 财务年度
  • Province [省份] — 公司注册所在省份
  • ProvinceCode [省份代码] — 省份行政区划代码(6位)
  • City [城市] — 公司注册所在城市
  • CityCode [城市代码] — 城市行政区划代码(6位)
  • County [区县] — 公司注册所在区县
  • CountyCode [区县代码] — 区县行政区划代码(6位)
  • IndustryCode [行业代码] — 中上协行业分类代码
  • IndustryName [行业名称] — 中上协行业分类名称
  • CustomParagraphs [定制能力段落数] — 参考叶阳平等(2025,中国工业经济)附录5的方法,MD&A文本中包含产品定制能力关键词的段落数量。单位:个
  • KeywordFreq [定制关键词词频] — 参考叶阳平等(2025,中国工业经济)附录6的63个产品定制能力关键词,在MD&A文本中的总出现次数。单位:次
  • Customization [产品定制能力] — 参考叶阳平等(2025,中国工业经济)附录5第六步的方法,计算公式为:定制段落数与关键词熵值分别进行年度内z-score标准化后等权加权,值越大代表企业产品定制能力越强

常见问题

「产品定制能力(MD&A关键词熵)」是什么数据集?
产品定制能力(MD&A关键词熵),隶属经营绩效。衡量企业根据客户需求进行产品定制的能力。
该数据集的时间范围是?
覆盖 1991-2025 年。
包含哪些变量/指标?
共 14 个变量。核心指标包括:定制能力段落数、定制关键词词频、产品定制能力。完整字段清单(变量名·中文名·说明)见页面「字段字典」。
数据频率和层级是怎样的?
频率为年度,上市公司层级。
样本量有多大?
约 67,320 条观测。
数据是如何测算/获取的?
指标定义与计算方法 产品定制能力反映了企业根据客户个性化需求设计和生产产品的能力,是衡量企业市场适应性和创新能力的重要指标。本数据集参考叶阳平等(2025)的研究,基于上市公司年度报告中的“管理层讨论与分析”(MD&A)文本,通过关键词分析方法构建产品定制能力指标。 首先,从MD&A文本中提取两个基础子指标。第一个子指标是定制能力段落数(CustomParagraphs),即MD&A文本中包含产品定制能力关键词的段落总数。第二个子指标是定制关键词词频(KeywordFreq),即附录6所列的63个产品定制能力关键词在MD&A文本中出现的总次数。基于关键词词频,进一步计算关键词熵值,用以衡量关键词分布的多样性。 最终的产品定制能力指标(Customization)是上述两个子指标的综合。具体计算过程为:首先,将定制能力段落数和关键词熵值分别进行年度内的z-score标准化处理,以消除年度间和截面上的量纲差异。然后,将标准化后的两个子指标进行等权加权平均,得到综合指标。该指标值越大,代表企业的产品定制能力越强。 补充说明 - 文本分析基于上市公司年度报告的MD&A部分。 - 产品定制能力关键词列表包含63个关键词,具体内容参见叶阳平等(2025)附录6。 - 最终的综合指标(Customization)经过了年度内的标准化处理。 参考文献 [1]叶阳平,马文聪,吴小节,等.人工智能与产业技术融合对制造业企业产品创新绩效的影响研究[J].中国工业经济,2025(11):150-168.
如何获取该数据集?
通过站内对应淘宝链接下单后,客服发放兑换码;在站内"兑换"页输入兑换码即可获得下载权益并下载。