企业资产结构错配(行业标准化偏离度)

「企业资产结构错配(行业标准化偏离度)」,覆盖 2007-2025 年,频率 年度,上市公司层级,含 19 个变量,样本量约 82,047。 衡量企业资产配置偏离行业平均水平的程度。

时间跨度2007-2025 年
数据频率年度
层级上市公司
变量数19
样本量82,047
是否可合并可与同主体数据集合并

字段字典

  • Symbol [股票代码] — 6位股票代码
  • StkName [证券简称] — 上市公司证券简称
  • Year [年份] — 会计年度
  • Province [省份] — 公司注册地所在省份
  • ProvinceCode [省份代码] — 公司注册地省份行政区划代码
  • City [城市] — 公司注册地所在城市
  • CityCode [城市代码] — 公司注册地城市行政区划代码(6位)
  • County [区县] — 公司注册地所在区县
  • CountyCode [区县代码] — 公司注册地区县行政区划代码(6位)
  • IndustryCode [行业代码] — 中上协行业分类代码(如C26、J66,按年度动态匹配公司当年所属行业)
  • IndustryName [行业名称] — 中上协行业分类名称(按年度动态匹配公司当年所属行业)
  • FinAssetRatio [金融资产占比] — 参考李伟明等(2025,管理评论)的方法,计算公式为:金融资产/总资产,其中金融资产为交易性金融资产、衍生金融资产、长期股权投资、持有至到期投资、可供出售金融资产,以及2018年新金融工具准则实施后的债权投资与其他债权投资之和;原准则的可供出售金融资产在新准则下拆分为债务工具与权益工具两类,本指标纳入其中可稳定获取的债务工具部分,故新准则期间的金融资产口径较原准则期间略窄。受准则变更影响,该比重在实施前后存在口径断点,跨该时点作时序比较时建议控制年份固定效应。该比重是资产结构错配指标的五个构成维度之一。
  • FixAssetRatio [固定资产占比] — 参考李伟明等(2025,管理评论)的方法,计算公式为:固定资产/总资产。该比重是资产结构错配指标的五个构成维度之一。
  • IntanAssetRatio [无形资产占比] — 参考李伟明等(2025,管理评论)的方法,计算公式为:无形资产/总资产。该比重是资产结构错配指标的五个构成维度之一。
  • ARRatio [应收账款占比] — 参考李伟明等(2025,管理评论)的方法,计算公式为:应收账款/总资产。该比重是资产结构错配指标的五个构成维度之一。
  • InventoryRatio [存货占比] — 参考李伟明等(2025,管理评论)的方法,计算公式为:存货/总资产。该比重是资产结构错配指标的五个构成维度之一。
  • IndYearN [行业基准样本公司数] — 估计该观测所属行业基准时实际纳入的在市公司数量,即当年本行业已上市且未退市的公司数;当年本行业在市公司数不足10家时基准回退为当年全市场在市公司统计,此列相应记录当年全市场在市公司数。该列用于识别基准样本过小的观测(其资产结构错配水平系统性偏高,不宜与基准样本充足的观测直接比较),同时是资产结构错配(标准误口径)的尺度因子。单位:家。
  • ASM [资产结构错配] — 参考李伟明等(2025,管理评论)与许志勇、韩炳(2023,系统工程理论与实践)的方法,计算公式为:资产结构错配=(1/5)×Σ|(本企业该类资产占总资产比重-当年本行业该比重的平均值)/当年本行业该比重的标准差|,五类资产依次为金融资产、固定资产、无形资产、应收账款与存货,行业采用中上协行业分类粗分组(制造业取前两位、非制造业取首字母)并按年度动态匹配当年实际归属(当年无分类记录时回退采用该公司最近一次可得的分类);行业平均值与标准差仅由当年已上市且未退市的公司估计,企业上市前与退市后的年度不参与基准估计但仍计算本指标。用作研究变量,越大代表企业资产配置偏离行业平均水平越远、资产结构错配程度越高。
  • ASMSE [资产结构错配(标准误口径)] — 参考李伟明等(2025,管理评论)式(3)将标准化分母表述为标准误的字面口径,作为资产结构错配的稳健性替代度量,计算公式为:资产结构错配(标准误口径)=资产结构错配×√(行业基准样本公司数),即将标准化的分母由当年本行业该比重的标准差替换为其标准误。该口径的绝对水平随行业基准样本规模同步放大,跨行业与跨年度不可比,使用时须加行业与年份固定效应;且在同一行业与年度内该列为资产结构错配的常数倍变换,不构成独立于资产结构错配的稳健性度量,仅供复现原文字面公式使用。

常见问题

「企业资产结构错配(行业标准化偏离度)」是什么数据集?
企业资产结构错配(行业标准化偏离度),隶属资本结构。衡量企业资产配置偏离行业平均水平的程度。
该数据集的时间范围是?
覆盖 2007-2025 年。
包含哪些变量/指标?
共 19 个变量。核心指标包括:金融资产占比、固定资产占比、无形资产占比、应收账款占比、存货占比、行业基准样本公司数、资产结构错配、资产结构错配(标准误口径)。完整字段清单(变量名·中文名·说明)见页面「字段字典」。
数据频率和层级是怎样的?
频率为年度,上市公司层级。
样本量有多大?
约 82,047 条观测。
数据是如何测算/获取的?
指标定义与计算方法 资产结构指企业内部各项资产之间的比例与配置关系,而资产结构错配则指企业的资产配置偏离其最优产出配置方式。资产组合理论与资源有限理论认为,企业资源是有限的,资产结构的有效配置就是让有限的资产获得最大的产出;配置方向一旦偏离,将引发资源的无谓消耗与生产环节的瓶颈,抑制企业的运营效率与长期发展。由于"最优配置"在企业层面不可直接观测,实证研究通常以同行业企业的平均配置结构作为参照基准,用企业自身资产结构相对该基准的偏离幅度来刻画错配程度。 本数据集依据这一思路,从金融资产、固定资产、无形资产、应收账款与存货五类资产入手构建指标。其中金融资产按各会计期间适用准则下的科目归集:交易性金融资产、衍生金融资产、长期股权投资,加上原准则下的持有至到期投资与可供出售金融资产,以及现行准则下的债权投资与其他债权投资。需要说明的是,原准则的可供出售金融资产在现行准则下拆分为债务工具与权益工具两类,本指标纳入其中可在报表中稳定获取的债务工具部分,因此现行准则期间的金融资产口径较原准则期间略窄。上述科目在报表中留空表示企业当期不持有该项资产,计算时按零处理。五类资产分别除以总资产,得到企业当期的资产结构向量,其分量记为 $F{a,i,t}$,表示企业 $i$ 在第 $t$ 期第 $a$ 类资产占总资产的比重。 在此基础上,对每一类资产的占比按当期所属行业作标准化:先减去当期本行业该类资产占比的平均值 $\overline{F}{a,j,t}$,再除以当期本行业该类资产占比的标准差 $\sigma{a,j,t}$,并取绝对值,得到该类资产偏离行业平均水平的标准化幅度。最后对五个维度的偏离幅度取算术平均,即得企业当期的资产结构错配水平: $$ASM{i,t}=\frac{1}{5}\sum{a=1}^{5}\left|\frac{F{a,i,t}-\overline{F}{a,j(i),t}}{\sigma{a,j(i),t}}\right|$$ 其中 $j(i)$ 表示企业 $i$ 当期所属的行业。取绝对值意味着该指标衡量的是配置结构相对行业基准的"距离"而非方向:无论某类资产是配置过度还是配置不足,都构成对最优结构的偏离。指标数值越大,说明企业的资产结构越偏离行业平均水平,资产结构错配程度越高。 行业划分采用中国上市公司协会行业分类,并归并为粗分组后使用:制造业取门类字母加一位大类代码,非制造业取门类字母。之所以不按完整的大类代码分组,是为了让每个行业年组保有足够的样本量来稳定估计均值与标准差。行业归属按年度动态匹配企业当期的实际分类,以反映企业的跨行业变更;当某企业在某一年度没有分类记录时(企业上市前的回溯年度尤为常见),则回退采用该企业最近一次可得的分类,此时该观测使用的并非其当期分类。轨迹中完全没有分类记录的主体不参与计算,这部分主要是新三板、北交所与纯 B 股主体。 行业基准(即上式中的 $\overline{F}{a,j,t}$ 与 $\sigma{a,j,t}$)仅由当期已上市且尚未退市的公司估计。这一处理与"本行业上市公司平均水平"的构念相一致:上市公司在招股环节披露的上市前若干年度财务数据虽然可得,但这些年度的企业尚不在市,且只有最终成功上市的企业才会留下此类回溯记录,若纳入基准会使参照系掺入经过前视筛选的非上市样本。企业上市前与退市后的年度本身仍照常计算并输出本指标,只是不参与基准的估计。当某一行业当期在市公司数量过少、组内均值与标准差不足以稳定估计时,该组的基准回退为当期全市场在市公司的统计量。 除核心指标外,本数据集一并输出五类资产各自的占比,便于研究者识别错配主要由哪一维度驱动、或在机制分析中单独使用某一维度;同时输出行业基准样本公司数,记录估计该观测所属基准时实际纳入的在市公司数量。此外提供一个标准误口径的替代度量 $ASM^{SE}{i,t}$,其构造与核心指标一致,仅将标准化的分母由行业内标准差替换为相应的标准误,二者满足 $ASM^{SE}{i,t}=ASM{i,t}\cdot\sqrt{n{j,t}}$,其中 $n{j,t}$ 即上述行业基准样本公司数。 补充说明 - 两种口径的选用:核心指标以行业内标准差为标准化分母,其数值不随行业规模变化,在不同行业、年度与样本范围之间具有可比性,适合直接作为连续变量进入回归。标准误口径的数值随行业基准样本规模同比例放大,不宜用于跨行业或跨年度的水平比较;且在同一行业与年度内部,它只是核心指标的常数倍变换,加入行业与年份固定效应后与核心指标秩序完全一致,因此不构成独立于核心指标的稳健性证据,仅供复现原文字面公式之用。 - 基准样本规模:行业基准样本公司数较小的观测,其标准化幅度会系统性偏高,主要出现在住宿餐饮、金融、居民服务、教育、卫生等小行业的早期年份。建议在跨行业比较时借助该列剔除或控制基准样本过小的观测。 - 金融资产的准则口径:新金融工具准则实施前后,原可供出售金融资产项下的理财与结构性存款等大量重分类至交易性金融资产,使金融资产占比的水平与行业内离散度在该时点前后不连续。跨越该时点作时序比较、双重差分或事件研究时,需控制年份固定效应或分段设定样本,以免将准则变更误读为处理效应。 - 样本口径:本数据集自 2007 年新企业会计准则施行起算,覆盖各期按一般工商业报表模板披露完整年度资产负债表的上市公司;以该年为起点,是因为此前的资产负债表科目口径与其后不可比。银行、保险与证券公司使用专用报表模板,因此不在样本内;但并未按行业代码额外剔除金融门类,少数沿用一般工商业模板的多元金融类公司仍予保留。数据未预先剔除特殊处理股票,也未对连续变量作缩尾处理。原始方法的实证样本为战略性新兴产业 A 股公司、区间为 2020 年至 2023 年,且剔除了特殊处理股票与金融行业、对连续变量作双边百分之一缩尾;本数据集的覆盖范围更宽,研究者可依据自身设定自行施加上述限制。 - 面板设定提示:上游代码体系中存在同一经济主体对应两套证券代码的情形(以北交所新旧代码平移为主,另有借壳与代码变更)。直接按证券代码做企业固定效应或聚类会把同一主体当作两家,建议先行合并或择一保留。 - 指标的覆盖范围:该指标只涵盖上述五类资产,货币资金、在建工程、商誉等不在其中。由于各类资产占比均以零为下界,向下偏离存在数学上限而向上偏离无界,指标实质刻画的是"某类资产占比异常偏高",对"资产过度沉淀于现金"不敏感,二者甚至呈弱负向关系。将本指标用作中介变量时,建议同时控制货币资金占总资产的比重。 参考文献 - 李伟明,曹霞,张鑫.数绿技术融合、资产结构错配与企业高质量发展——知识组合能力的调节作用[J].管理评论,2025,37(11):54-66. - 许志勇,韩炳.资产结构错配与企业高质量发展——技术创新与融资约束的中介效应[J].系统工程理论与实践,2023,43(10):2881-2905. - 许志勇,张娜,张少勇,等.资产结构错配与企业高质量发展[J].中国管理科学,2024,32(10):286-300.
如何获取该数据集?
通过站内对应淘宝链接下单后,客服发放兑换码;在站内"兑换"页输入兑换码即可获得下载权益并下载。