Krugman专业化指数

「Krugman专业化指数」,覆盖 1992-2024 年,频率 年度,省级层级,含 13 个变量,样本量约 1,023。 衡量各省产业结构偏离全国平均水平的专业化程度,计算逻辑为Krugman指数K=0.

时间跨度1992-2024 年
数据频率年度
层级省级
变量数13
样本量1,023
是否可合并可与同主体数据集合并

字段字典

  • Province [省份名称] — 省份的中文名称.
  • ProvinceCode [省份代码] — 省份的相关统计部门代码 (6 位字符串).
  • Year [年份] — 统计年份.
  • PrimaryVa [第一产业增加值(亿元)] — 第一产业增加值是指按市场价格计算的一个国家(或地区)所有常住单位在一定时期内从事第一产业生产活动的最终成果。第一产业是指农、林、牧、渔业。
  • SecondaryVa [第二产业增加值(亿元)] — 第二产业增加值是指按市场价格计算的一个国家(或地区)所有常住单位在一定时期内从事第二产业生产活动的最终成果。第二产业是指采矿业,制造业,电力、煤气及水的生产和供应业,建筑业。
  • TertiaryVa [第三产业增加值(亿元)] — 第三产业增加值是指按市场价格计算的一个国家(或地区)所有常住单位在一定时期内从事第三产业生产活动的最终成果。第三产业是指除第一、二产业以外的其他行业。
  • IndVa [工业增加值(亿元)] — 工业增加值是指工业企业在报告期内以货币形式表现的从事工业生产活动的最终成果。工业增加值有两种计算方法:一是生产法,即工业总产出减去工业中间投入加上应交增值税;二是收入法,即从收入的角度出发,根据生产要素在生产过程中应得到的收入份额计算,具体构成项目有固定资产折旧、劳动者报酬、生产税净额、营业盈余。
  • ConstrVa [建筑业增加值(亿元)] — 建筑业增加值是指建筑业企业在报告期内以货币形式表现的从事建筑业生产活动的最终成果。目前建筑业增加值采用收入法计算,即从收入的角度出发,根据生产要素在生产过程中应得的收入份额计算。
  • WhRetailVa [批发和零售业增加值(亿元)] — 批发和零售业增加值是指按市场价格计算的一个国家(或地区)所有常住单位在一定时期内从事批发和零售业生产活动的最终成果。
  • TransPostVa [交通运输、仓储和邮政业增加值(亿元)] — 交通运输、仓储和邮政业增加值是指按市场价格计算的一个国家(或地区)所有常住单位在一定时期内从事交通运输、仓储和邮政业生产活动的最终成果。
  • FinanceVa [金融业增加值(亿元)] — 金融业增加值是指按市场价格计算的一个国家(或地区)所有常住单位在一定时期内从事金融业生产活动的最终成果。
  • REVa [房地产业增加值(亿元)] — 房地产业增加值是指按市场价格计算的一个国家(或地区)所有常住单位在一定时期内从事房地产业生产活动的最终成果。
  • KrugmanSpecialization [Krugman专业化指数] — Krugman专业化指数。计算公式:0.5 * sum_i |VA_i/GDP_p - VA_i/GDP_national|。

常见问题

「Krugman专业化指数」是什么数据集?
Krugman专业化指数,隶属综合经济。衡量各省产业结构偏离全国平均水平的专业化程度,计算逻辑为Krugman指数K=0.
该数据集的时间范围是?
覆盖 1992-2024 年。
包含哪些变量/指标?
共 13 个变量。核心指标包括:第一产业增加值(亿元)、第二产业增加值(亿元)、第三产业增加值(亿元)、工业增加值(亿元)、建筑业增加值(亿元)、批发和零售业增加值(亿元)、交通运输、仓储和邮政业增加值(亿元)、金融业增加值(亿元)、房地产业增加值(亿元)、Krugman专业化指数。完整字段清单(变量名·中文名·说明)见页面「字段字典」。
数据频率和层级是怎样的?
频率为年度,省级层级。
样本量有多大?
约 1,023 条观测。
数据是如何测算/获取的?
指标定义与计算方法 Krugman专业化指数衡量一个省份的产业结构与全国平均产业结构之间的偏离程度,是区域经济学中用于测度地区产业专业化或差异化水平的核心指标。该指数越大,表明该省的产业结构越偏离全国平均水平,即专业化程度越高;反之则表明产业结构与全国趋同。引入该指数的动机在于刻画各省在产业分工中的相对定位,为分析区域比较优势、产业集聚与转移提供量化依据。数据来源为相关统计部门年度公开数据中的分行业增加值与地区生产总值。计算公式如下: $$ K{p} = 0.5 \times \sum{i} \left| \frac{VA{i,p}}{GDP{p}} - \frac{VA{i,national}}{GDP{national}} \right| $$ 其中,\(VA{i,p}\) 为省份 \(p\) 第 \(i\) 行业的增加值,\(GDP{p}\) 为省份 \(p\) 的地区生产总值;\(VA{i,national}\) 为全国第 \(i\) 行业的增加值,\(GDP{national}\) 为全国国内生产总值。计算步骤包括:首先,分别计算各省份各行业增加值占本省GDP的比重(\(s{ip}\))以及全国各行业增加值占全国GDP的比重(\(s{in}\));其次,对每个行业计算两者差值的绝对值;然后,对所有行业求和;最后乘以0.5以保证指数取值在[0,1]区间内。全国基准采用31个省(自治区、直辖市)加总数据作为代理。该指数为无量纲指数,取值范围为[0,1],典型量级在0.1至0.6之间,数值越大表示专业化程度越高。 补充说明 计算中涉及的行业分类基于相关统计部门公布的国民经济行业分类标准,具体涵盖以下行业:农林牧渔业(PrimaryVa)、工业(SecondaryVa)、建筑业(TertiaryVa)、批发和零售业(IndVa)、交通运输仓储和邮政业(ConstrVa)、住宿和餐饮业(WhRetailVa)、金融业(TransPostVa)、房地产业(FinanceVa)、其他服务业(REVa)。缺失数据采用线性插值或相邻年份均值填补。计算粒度为省级(Province),主键为ProvinceCode和Year。已知限制包括:行业分类调整可能导致跨年口径不一致;全国基准采用各省加总而非官方全国数据,可能引入微小偏差;指数对行业细分程度敏感,细分行业越多,指数可能越高。 参考文献 [1] Krugman, P. (1991). Geography and Trade. MIT Press.
如何获取该数据集?
通过站内对应淘宝链接下单后,客服发放兑换码;在站内"兑换"页输入兑换码即可获得下载权益并下载。