分配研究 · 03贫富差距与基尼系数本章约 9 分钟

Interpretation · 分布图景

一个数字之外的社会结构

第 3 章 / 共 3 章

面积相同的曲线可以拥有不同形状;分配位置、实际生活水平和制度作用,需要由其他信息重新展开。

≠
相同的基尼系数,不等于相同的收入分布,也不等于相同的生活水平

一个面积比例会隐藏曲线的具体形状。底部贫困、顶部集中和中间层收缩,可能得到相近的数值。

基尼系数把整条洛伦兹曲线压缩成面积,因此必然丢失曲线在哪里弯曲的信息。底部与中部拉开、顶部远离其余人群,或者中间层同时向两端分化,都可能围出相近面积。系数适合概括总体不均,却不能单独还原社会的分层结构。

五户案例的基尼系数为 0.40,最高收入家庭获得总收入的 50%,中位家庭收入为 6,均值为 8。四个数字来自同一分布,却分别描述整体面积、顶部份额、中间位置和平均资源,彼此不能替代。

0.40 概括整条曲线,50% 定位顶部份额,6 与 8 的距离则显示分布向高收入一侧拖出长尾。如果再加入税收转移前后的两条曲线,还能观察公共制度如何改变家庭最终获得的资源。基尼系数没有失去价值,只是从“全部答案”回到了“总体摘要”的位置。

这种信息压缩与地图相似:全国平均海拔可以比较整体地势,却无法指出山脉和盆地坐落何处。分位份额、贫困率、中位收入与税前税后分布,就是把被面积隐藏的地形重新展开。

可比性的前提:同名指标未必测量同一分布

基尼系数没有脱离数据定义而独立存在。工资、市场收入、可支配收入、消费和净财富是不同资源;个人、家庭和等值化家庭成员是不同观察单位。即使最终都写成“基尼”,底层分布一旦不同,数字就没有直接的高低关系。

收入型调查记录一段时期的流量,消费型调查记录家庭支出,财富调查则在某个时点盘点资产与负债。消费通常比当期收入平滑,因为家庭可以储蓄、借贷或动用存量;财富又比收入更容易受到房价、金融资产和继承影响。这三类分布的集中程度往往不同。

人口范围也会改变曲线。以家庭为单位时,每户在横轴上占相同位置;以家庭成员为单位时,大家庭代表更多人口;等值化处理还会承认共同居住带来的规模经济。儿童、集体居住人口、零收入者和经营亏损家庭是否纳入,都会改变底部形状。

时间序列中的突然跳变有时来自问卷、抽样框、缺失值填补或等值尺度变化,而不是社会在一年内剧烈重组。同一调查体系的连续序列通常比不同机构拼接的序列更稳定,但经济结构、人口年龄和家庭形成变化仍会进入结果。

跨国排名还受到调查年份错位和抽样误差影响。相邻名次的差异可能小于统计不确定性,而一个国家使用收入、另一个使用消费。国际数据库因此常保留收入概念、调查来源和年份等元数据;这些说明不是附属文字,而是数字含义的一部分。

从面积回到形状:不平等指标的谱系

整体形状

基尼系数与完整曲线

系数概括总体弯曲程度,完整曲线则保留变化发生在哪些累计人口段。

两端距离

S80/S20

最高收入五分位的总收入除以最低收入五分位总收入。直观,但不使用中间 60% 的内部信息。

顶部集中

帕尔马比率

最高十分位份额除以最低四个十分位合计份额,突出顶部与底部之间的对照。

底部处境

相对贫困率

收入低于当期中位数一定比例的人口占比。它反映相对位置,不等同于固定购买力下的绝对贫困。

中位数回答“位于人群中间的人拥有什么”,均值回答“总收入平均分配会是多少”。当顶部收入很高时,均值会显著高于中位数。两者之比可以提示偏斜,却不能替代完整分布,也不能从中反推出唯一的基尼系数。

分位份额用于定位。最低 40% 的收入份额上升,说明底部相对于总体取得更多;最高 10% 或 1% 的份额则聚焦顶部集中。调查往往低估极高收入,研究顶部份额时可能需要税务行政资料,但税务资料的人口覆盖与收入定义又可能不同。将来源并列写清,比把数字强行拼成一条排行榜更可靠。

贫困指标补上最低生活状况。相对门槛随社会中位收入变化,适合观察参与主流生活的相对能力;固定实际购买力门槛更接近绝对生活需要。经济衰退时中位数下降,相对贫困线也可能下降,于是相对贫困率未必充分呈现生活恶化。最好同时报告门槛、贫困率和贫困缺口。

收入增长还需要按分位观察。若所有组都增长,但顶部增长更快,基尼可能上升,同时底部绝对收入也改善;若顶部大跌而底部小跌,基尼可能下降,但无人因此受益。把各分位实际收入增长率与分布指标放在一起,才能区分“共同增长但不均”“底部主导增长”“衰退式变平等”等不同情景。

这些指标不是为了组成一个更复杂的总分,而是保留分布的不同截面。基尼概括整体弯曲程度,分位份额定位差距,贫困指标描述底部与门槛的距离,中位实际收入则连接分配与生活水平。把它们重新压成单一评分,反而会再次丢失信息。

当两条洛伦兹曲线始终不相交,其中一条处处更靠近平等线时,对整体分布的排序比较明确;一旦曲线交叉,底部与中部可能朝相反方向变化。基尼系数仍会按照总面积给出高低,但不同社会价值取向可能更关注交叉点之前或之后的人群。

这也是不平等研究中会并存多种综合指标的原因。有些指标对底部变化更敏感,有些对顶部极端值反应更强。它们并非在争夺唯一正确答案,而是在使用不同权重观察同一条分布;选择哪一种,隐含着关注哪一部分人口。

均值、中位数与分布形状:一个现实例子

国家统计局公布,2024 年全国居民人均可支配收入为 41,314 元,中位数为 34,707 元,中位数相当于平均数的 84.0%。这组官方数据能够说明中间位置低于算术平均,且平均数会受到高收入值影响;它本身并不是基尼系数,也不足以给出完整分布形状。

为什么 84.0% 不能换算成一个唯一的基尼值?因为许多不同收入列表可以拥有相同的均值和中位数,却在底部、顶部与中间呈现完全不同的份额。均值和中位数只给出两个位置约束,洛伦兹曲线需要整条排序分布。把中位数/均值比直接叫作“贫富差距指数”,会过度解释数据。

这份发布同时说明,全国住户收支与生活状况调查采用分层、多阶段、与人口规模大小成比例的概率抽样,全国约 16 万个调查户。方法信息告诉我们数字来自何种总体推断,而不是网络问卷或简单平均。但若要与另一年份或另一来源比较,仍需确认样本、口径、价格与调查制度是否一致。

在一个完全对称的收入分布中,均值和中位数可能接近;当少数高收入观察值把右侧尾部拉长,均值通常高于中位数。84.0% 因而提示了右偏,但没有说明最低 20% 获得多少、最高 10% 是否高度集中,也不能确定洛伦兹曲线的面积。

设想两组十户家庭拥有相同均值和中位数:第一组的差距集中在最富一户,第二组则在上半部逐级拉开。两个位置统计量可以完全相同,分位份额和基尼系数却不同。反过来,两组收入也可能基尼相同而均值相差数倍。分配形状与总体水平属于两条不同的信息轴。

市场分配、公共再分配与长期流动

比较市场收入与可支配收入的分布,可以近似观察税收和现金转移如何改变不平等。这里把两者之间的指标差称为再分配效应。它是制度结果的描述,不自动等于某项政策的因果效果,因为领取者结构、就业和人口组成也可能同时变化。

若市场收入基尼上升而可支配收入基尼稳定,可能意味着税收转移抵消了更多市场差距;也可能是人口结构改变或测量误差。要把变化归因于某项税制或福利改革,需要更细的微观模拟、政策前后识别或反事实研究。描述性指标负责发现问题,因果设计负责解释来源。

分配还不只发生在某个时点。代际流动考察子女成年后的收入或社会经济位置相对于父母位置能否改变。一个当前收入差距较大的社会,如果机会流动充分,其含义可能不同于差距固化的社会;但高流动也不会自动取消当期贫困。横截面不平等与长期机会应并列观察。

评价政策时,至少区分四个目标:提高总体收入、改善底部生活、缩小相对差距、扩大机会流动。最低工资、教育投入、累进税、现金转移、住房供给和竞争政策作用渠道不同,也可能在目标之间存在时滞或权衡。用单一基尼变化给整个政策打分,会遗漏政策成本、行为反应和受益群体。

五户案例也能展示水平与分配的不同方向。若第二年的收入变为 3、5、7、9、20,底部四户都增加,总收入上升,顶部份额下降,洛伦兹曲线更接近平等线。若五户收入只是全部翻倍,生活资源增加而基尼不变。若衰退让最高收入下降得最快,基尼甚至可能下降,但总体生活水平同时恶化。

市场收入分布受到工资结构、就业、资本所有权和产业变化影响;可支配收入分布还叠加税收与现金转移。两条曲线之间的距离呈现制度对当期收入的改写,但医疗、教育等实物公共服务未必完全进入现金口径,其福利影响需要其他统计补充。

最终,公平判断仍包含价值选择。多大差距可以接受、哪些来源正当、应优先保证底线还是压缩顶部,不可能由统计量独自决定。数据能够澄清事实、揭示权衡和检验政策效果;社会目标需要公开讨论。把经验判断与价值判断分开,反而能让两者都更诚实。

因此,基尼系数没有一个脱离历史、制度与生活水平的天然“好坏阈值”。它描述相对分布,却不决定差距来源是否正当,也不说明低收入者是否达到体面生活。完整的社会图景来自多个维度之间的关系,而不是把更多判断塞回一个小数。