省内人口集聚HHI
「省内人口集聚HHI」,覆盖 1970-2024 年,频率 年度,地级市层级,含 7 个变量,样本量约 8,212。 衡量各省内部地级市间人口分布集中程度,反映人口向少数城市集聚的态势。
| 时间跨度 | 1970-2024 年 |
|---|---|
| 数据频率 | 年度 |
| 层级 | 地级市 |
| 变量数 | 7 |
| 样本量 | 8,212 |
| 是否可合并 | 可与同主体数据集合并 |
字段字典
- Province [省份名称] — 省份的中文名称.
- ProvinceCode [省份代码] — 省份的相关统计部门代码 (6 位字符串).
- City [地级市名称] — 地级市的中文名称.
- CityCode [地级市代码] — 地级市的相关统计部门 6 位代码.
- Year [年份] — 统计年份.
- Population [常住人口数(万人)] — 在某地区实际居住半年以上的人口总数。
- PopulationAgglomerationHHI [省内人口集聚HHI] — 省内人口集聚HHI。计算公式:sum_i (Pop_i / sum_i Pop_i)^2 within Province。
常见问题
- 「省内人口集聚HHI」是什么数据集?
- 省内人口集聚HHI,隶属人口。衡量各省内部地级市间人口分布集中程度,反映人口向少数城市集聚的态势。
- 该数据集的时间范围是?
- 覆盖 1970-2024 年。
- 包含哪些变量/指标?
- 共 7 个变量。核心指标包括:常住人口数(万人)、省内人口集聚HHI。完整字段清单(变量名·中文名·说明)见页面「字段字典」。
- 数据频率和层级是怎样的?
- 频率为年度,地级市层级。
- 样本量有多大?
- 约 8,212 条观测。
- 数据是如何测算/获取的?
- 指标定义与计算方法 省内人口集聚HHI(Herfindahl-Hirschman Index)衡量一个省份内部各地级市人口分布的集中程度,其经济学含义在于反映区域内部的空间集聚水平与城市规模分布特征。引入该指标旨在刻画省域内人口向少数大城市或中心城市集聚的趋势,为研究区域经济差异、城市化模式及空间溢出效应提供基础控制变量。数据来源为相关统计部门年度地级市人口数据(Population),经自主整理计算。完整计算公式如下: $$ HHI{p,t} = \sum{i \in p} \left( \frac{Pop{i,t}}{\sum{i \in p} Pop{i,t}} \right)^2 $$ 其中,\( p \) 表示省份,\( t \) 表示年份,\( i \) 表示该省份内的地级市,\( Pop{i,t} \) 为地级市 \( i \) 在年份 \( t \) 的年末总人口(Population)。计算步骤为:首先对每个省份-年份组合,计算省内所有地级市人口之和作为分母;然后计算每个地级市人口占该省总人口的份额;最后将各份额平方后加总。该指标取值范围为 \([1/N, 1]\),其中 \( N \) 为省内城市数量,取值越接近1表示人口越集中于少数城市,典型量级在0.1至0.5之间(视省份大小与城市数量而定)。单位为无量纲指数。 补充说明 简化假设:本指标将地级市视为省内基本空间单元,未考虑县级行政单位或市辖区内部差异;人口数据采用年末总人口,未区分户籍与常住人口。边界条件:年份覆盖范围为2000年至2020年,缺失地级市人口数据(如个别年份统计口径调整或数据未公布)采用线性插值法补齐;直辖市(北京、天津、上海、重庆)因省内仅有一个地级市单元,其HHI恒为1,在回归分析中建议单独处理或剔除。计算粒度为City主键(CityCode, Year),最终输出为Province-Year层面的面板数据。已知限制:该指标仅反映人口分布的集中程度,无法区分集聚是由首位城市主导还是多中心分布导致;此外,省内行政边界可能割裂跨省都市圈的人口流动,导致集聚测度存在边界效应。 参考文献 [1] Henderson, J. V. (2003). The urbanization process and economic growth: The so-what question. Journal of Economic Geography, 3(1): 47-71. [2] 范剑勇 (2006). 产业集聚与地区间劳动生产率差异. 经济研究, 41(11): 72-81.
- 如何获取该数据集?
- 通过站内对应淘宝链接下单后,客服发放兑换码;在站内"兑换"页输入兑换码即可获得下载权益并下载。