今天突然冒出来一个很奇怪的问题:
如果中国长期保持低生育率,姓氏会发生什么?
我们现在有六千多个仍在使用的姓,但王、李、张、刘、陈已经占了非常大的一块。那继续往后走几百年,会不会越来越向几个大姓集中?几个大姓最后会不会达到某种平衡?再极端一点——如果时间足够长,中国人会不会最后只剩下一个姓?
这个问题乍看像一个姓氏文化问题,但想了一会儿以后,我发现它其实可以被写成一个很标准的人口动力学问题:有限种群 + 低繁殖率 + 中性遗传 + 随机漂变。
于是干脆认真算了一遍。
先声明:这不是人口学预言,更不是“某个姓会在某年消失”的算命。下面所有遥远年份都只是模型压力测试,用来理解时间尺度和机制。
先看看今天的中国姓氏有多集中
公安部户政管理研究中心的全国姓名报告给了一个非常好的起点。
2018 年,全国仍在使用的姓氏约 6150 个,传统意义上的前 100 个大姓已经覆盖接近 85% 的户籍人口。到了 2020 年,王、李、张、刘、陈五个姓合计占全国户籍人口 30.8%。
换句话说,中国姓氏从来就不是六千多个姓平均分布,而是一个非常典型的“头部 + 长尾”结构:
- 最前面的几个姓,每个都是几千万甚至上亿人;
- 中间有大量几十万、几万人的姓;
- 尾部还有很多人口极少、地域高度集中的小姓和复姓。
而且大姓目前并没有明显出现谁在“碾压式扩张”。2020 年已登记新生儿中,李姓约 72.6 万,占全部已登记新生儿约 7.2%。这个量级和李姓在总人口中的份额并没有出现数量级上的偏离。
这件事很关键,因为它意味着至少在第一近似下,可以先把各姓看成没有稳定繁殖优势的中性类型。
一个最简单的姓氏模型
设第 i 个姓在第 g 代的人数为:
S_i(g)
全国人口为:
N(g)
这个姓在人口中的占比就是:
p_i(g) = S_i(g) / N(g)
如果各姓的平均生育水平相同,而且孩子从父母中继承一个姓,那么在足够大的群体里:
E[p_i(g+1)] ≈ p_i(g)
也就是说,低生育率本身并不会自动让王姓吃掉李姓,也不会让张姓稳定追上王姓。
它首先做的事情非常朴素:所有姓的人数一起下降。
例如把一代粗略取 30 年,把世代更替水平近似记为 2.1。若某个长期情景下总和生育率 TFR 只有 1.02,那么一代之后的人口规模系数可以非常粗略地写成:
r ≈ 1.02 / 2.1 ≈ 0.486
于是一个有 S 人的姓,在纯确定性近似下就是:
S(g+1) ≈ 0.486 × S(g)
显然,小姓会先掉到个位数,大姓则需要很多代。
但真正有意思的东西还没出现。
真正让姓氏越来越集中的,是随机漂变
假设一个姓只有 30 个人。
哪怕平均生育率和全国完全一样,只要其中几户连续没有孩子、一些孩子采用了另一方的姓,再叠加迁移、婚配和偶然死亡,这个姓就很可能在几代内消失。
但如果一个姓有 1 亿人,同样的随机波动几乎不可能在一代内造成任何决定性影响。
所以随着时间推移,会出现一种很自然的筛选:
几十人的姓先消失 → 几百人的姓 → 几千人的姓 → 几万人的姓……
注意,这不是“大姓比较能生”,而是小样本更容易被随机波动清零。
如果用一个很简单的姓氏集中度:
H = Σ p_i²
那么在有限人口的随机抽样过程中,小姓不断退出,H 会有向上漂移的趋势。也就是说,姓氏结构长期确实存在越来越集中的数学倾向。
所以第一个结论是:
未来中国姓氏大概率会继续发生“长尾收缩”,大姓占比被动提高。
那最后会不会变成“王李张刘陈各占 20%”?
不会。
这里有一个很容易产生的误解:既然几个大姓都很大,是不是最后会逐渐达到某种平衡?
问题是,这个系统里根本没有“把大姓拉回平均值”的力。
假如王姓从 7% 随机涨到 8%,没有任何机制会因为“王姓太多了”而主动压低王姓生育率;李姓从 7% 掉到 6%,也没有机制会自动补偿李姓。
所以几个大姓之间不存在类似生态系统资源竞争那样的稳定均衡点。
在一个最极端的数学模型里,如果满足下面几个条件:
- 人口始终有限;
- 没有新姓产生;
- 没有外部人口输入;
- 所有姓完全中性;
- 系统一直运行无限久;
那么最终的吸收态不是“几个大姓平衡”,而是:
只剩一个姓。
这和遗传漂变里一个中性等位基因最终固定是同一个数学结构。
而且在最简单的中性模型里,一个姓成为最后幸存者的概率,大致就是它当前的占比。王姓并不会因为现在第一大就“必胜”;它只不过比一个万分之一的小姓拥有高得多的最终固定概率。
但“一家统一”在现实里几乎没有意义
这时候模型开始变得很有哲学味。
假设中国人口长期稳定在几亿甚至十几亿,随机漂变让一个姓最终固定所需要的时间,可以长到远远超过任何有现实讨论价值的文明尺度。
更何况真实世界还不断违反模型假设:
- 孩子可以随父姓,也可以随母姓;
- 2020 年全国姓名报告显示,新生儿随母姓与随父姓的比例已经约为 1:12;
- 复姓、双姓和姓氏组合仍会出现;
- 人口迁移和跨国婚姻会带来新的姓氏输入;
- 法律和社会习惯未来完全可能继续变化。
这些现象在数学上都相当于给系统不断加入“突变”和“迁移”。
所以现实世界更可能出现的是:
姓氏数量减少、头部份额提高,但始终保留一个长尾,而不是全中国最终只剩王或者李。
最有趣的问题:常见姓氏要多久才会“灭绝”?
既然已经走到这里,我干脆做一个非常极端的压力测试。
我采用公安部 2018 年姓名报告中公开的大姓人口作为初始基数。需要注意,这些是 2018 年数据,不是 2026 年精确人口;我使用它们只是因为这是一套公开、完整且量级可靠的姓氏基数。
然后设置两个假想情景。
情景 A:超低生育率永久冻结
假设从现在开始,TFR 永远固定在 1.02,一代 30 年,世代更替水平取 2.1。
每一代人口系数:
r = 1.02 / 2.1 ≈ 0.486
我不把“预计剩下 0.8 个人”当成真正的人口,而是把某姓的模型期望人数第一次跌破 1 的年份,定义为一个非常粗糙的理论消失阈值年。
情景 B:低生育率逐步恢复,但仍明显低于更替水平
第二个情景稍微温和一些:近几十年从约 1.02 缓慢恢复,三代分别近似取 1.02、1.20、1.32,随后长期停在 1.35。
这个设定不是对 22 世纪的真实预测,只是模拟“低生育率有所恢复,但没有回到 2.1”的情况。
算出来的时间尺度如下:
| 姓氏 | 初始人口基数 | 情景 A:TFR=1.02 长期不变 | 情景 B:逐步恢复至 1.35 |
|---|---|---|---|
| 王 | 1.015 亿 | 约 2806 年 | 约 3256 年 |
| 李 | 1.009 亿 | 约 2806 年 | 约 3256 年 |
| 张 | 9540 万 | 约 2806 年 | 约 3256 年 |
| 刘 | 7210 万 | 约 2806 年 | 约 3226 年 |
| 陈 | 6330 万 | 约 2776 年 | 约 3226 年 |
| 杨 | 4620 万 | 约 2776 年 | 约 3196 年 |
| 黄 | 3370 万 | 约 2776 年 | 约 3196 年 |
| 赵 | 2860 万 | 约 2746 年 | 约 3166 年 |
| 吴 | 2780 万 | 约 2746 年 | 约 3166 年 |
| 周 | 2680 万 | 约 2746 年 | 约 3166 年 |
| 欧阳 | 111.2 万 | 约 2626 年 | 约 2956 年 |
| 上官 | 8.8 万 | 约 2506 年 | 约 2776 年 |
| 诸葛 | 4.8 万 | 约 2476 年 | 约 2746 年 |
| 司马 | 2.3 万 | 约 2446 年 | 约 2686 年 |
| 慕容 | 约 5000 | 约 2386 年 | 约 2596 年 |
| 长孙 | 约 3000 | 约 2386 年 | 约 2566 年 |
第一次看到这个表时,我觉得最反直觉的不是“王姓还能活很久”,而是另一件事:
1 亿人的大姓和只有几千人的小姓,理论消失时间竟然只差几百年,而不是差几万倍。
原因很简单。
当每代都按固定比例衰减时,消失时间近似和初始人数的对数有关:
T ∝ ln(S₀) / |ln(r)|
人口从 3000 增加到 3 万,是乘 10;从 3 万增加到 30 万,又只是再乘 10。每乘一个数量级,本质上只是多撑若干代,而不是按人数线性增加寿命。
这也是指数变化最容易欺骗人直觉的地方。
不过,这张表不能被理解成“王姓会在 2806 年灭绝”
恰恰相反。
如果 TFR=1.02 真的持续几百年,不只是王姓在减少——整个中国人口都在以极端速度跨代收缩。
所以“王姓 2806 年跌破一人”并不是一个关于王姓失败的预言,它更接近:
如果一个十几亿人口社会在八百年里始终保持今天这种极低世代更替率,而且没有任何结构变化,那么到最后连最大的姓也会随着总体人口一起耗尽。
这显然已经远远超出合理人口预测范围。
只要未来生育率重新接近世代更替水平,模型结果就会完全改变。若长期达到或超过更替水平,大姓的“有限灭绝年”甚至会直接失去意义。
所以真正值得看的不是表格里的具体年份,而是不同人口规模对应的风险顺序。
真正可能在我们能想象的历史尺度里发生的,是小姓消失
王、李、张这种亿人大姓,21 世纪根本不需要讨论灭绝。
真正脆弱的是人口非常少、而且高度地域集中的姓。
公安部 2021 年姓名报告专门提到,中国姓氏存在明显的地域聚集。一些小复姓绝大多数人口集中在少数省份。这种结构意味着它们不仅面对全国低生育率,还会额外受到当地人口流出、婚配半径扩大、年轻人迁移和随另一方姓氏等影响。
因此真实世界的小姓灭绝速度,反而可能比“全国随机混合模型”更快、更不稳定。
我觉得如果真要继续做这个问题,下一步最值得拿到的数据不是王姓到底 1.01 亿还是 1.02 亿,而是:
- 全国有多少姓人口不足 100 人;
- 多少姓不足 1000 人;
- 多少姓不足 1 万人;
- 这些姓分别集中在哪些县、市、省;
- 不同姓的新生儿姓氏份额是否和存量份额一致;
- 随母姓、双姓和新姓氏组合正在以什么速度增加。
如果这些数据足够完整,就可以真正做一个分省、分年龄、分婚配网络的 Monte Carlo 模拟,而不是今天这个极简脑洞模型。
最后,我现在的答案
回到最开始的三个问题。
中国姓氏会不会越来越向大姓集中?
会。有限人口下的随机漂变会不断淘汰极小姓氏,低生育率又会让小姓更快进入危险人口区间,因此姓氏集中度长期有上升趋势。
会不会最后形成几个大姓的稳定平衡?
不会自然形成。系统里没有任何自动把王、李、张拉向相同份额的恢复力。
无限久以后会不会一家统一?
在“封闭、有限、中性、没有新姓”的纯数学模型里,会,最终吸收态就是一个姓。但这个时间尺度巨大,而且现实社会不断产生姓氏重组、母姓传递和人口流动,所以它几乎只是一个数学结论。
更现实的未来,大概是:
六千多个姓的长尾逐渐变短,几十个、几百个大中型姓更加显眼;但只要社会仍然开放、姓氏规则仍然可以变化,就很难真正走到“一姓天下”。
一个吃早饭时突然冒出来的问题,最后居然一路连到了人口学、随机过程和遗传漂变。
这种脑洞还挺有意思。
数据与参考
- 国家统计局:《中华人民共和国2025年国民经济和社会发展统计公报》:2025 年末全国人口 14.0489 亿,全年出生 792 万人、死亡 1131 万人。
- 央视网:公安部发布 2018 全国姓名报告:全国在用姓氏约 6150 个,王、李均超过 1 亿,23 个姓超过 1000 万。
- 中新网:《二〇二〇年全国姓名报告》相关报道:王、李、张、刘、陈五姓占全国户籍人口 30.8%,2020 年李姓新生儿 72.6 万。
- 中新网:姓氏文化与 2020 全国姓名报告:目前在用姓氏 6000 多个;2020 年新生儿随母姓与随父姓比例约 1:12。
- 湖南省公安厅:《二〇二一年全国姓名报告》:常见姓氏的地域分布与空间聚集情况。
- United Nations, World Population Prospects 2024:本文低生育率情景的国际人口预测背景参考。模型中的 22 世纪以后参数是本文自行设置的压力测试,不代表联合国正式预测。
Comments
评论