直播并发承载怎么算?开播前压测与扩容的实操方法
"这场直播能扛多少人"是每个主办方的第一问,但多数回答都停留在拍脑袋。本文给出一套可复用的估算与验证方法:报名数怎么换算峰值并发、带宽账怎么算、阶梯压测看哪三个指标、超出承载时的分级预案。
一、先分清三个"并发"概念
很多人把"报名 5000 人"当成"5000 人并发",预算和方案立刻失真。先对齐三个概念:
| 概念 | 含义 | 用在哪里 |
|---|---|---|
| 报名数 | 所有可能来的人,是营销口径 | 只用于到场率估算的基数 |
| 峰值并发 | 同一时刻在线的观众数最大值,通常出现在开播后 3–10 分钟 | 承载能力评估的唯一基准 |
| 平均并发 | 整场平均在线数,一般是峰值的 50%–70% | 用于流量费用预估(消耗时长 × 人数) |
做方案只需要盯一个数:峰值并发。后面的压测、扩容判断全部以它为准。
二、峰值并发估算:报名数 × 两个折扣
经验公式:峰值并发 = 报名数 × 到场率 × 同时在线率。两个折扣系数按场次类型取值:
| 场次类型 | 到场率 | 同时在线率 | 说明 |
|---|---|---|---|
| 免费公开课 / 行业直播 | 30%–50% | 80%–90% | 报名门槛低,爽约率高 |
| 企业内部培训 / 全员会 | 50%–70% | 85%–95% | 有行政通知,到场率高但中途流失 |
| 付费课程 / 收费峰会 | 60%–80% | 85%–95% | 付了钱的到场率显著更高 |
| 有短信/邮件强提醒 | 各档 +10–15% | 不变 | 开播前 30 分钟与 5 分钟两次提醒效果最好 |
举例:报名 2000 人的行业直播,到场率取 40%、同时在线取 90%,峰值并发约 720。方案、套餐选型和费用测算按这个数走,而不是 2000。
三、带宽账:大部分焦虑来自算错了方向
很多人以为"观众越多,我这边带宽要越大"——方向错了。分两条线算:
- 推流端(你这边):固定占用一条上行,等于推流码率。1080p 4Mbps 就是一条稳定的 4Mbps 上行,和观众数无关。要保证的是这条上行的稳定性(有线接入、留 50% 余量),不是带宽总量。
- 观众侧:每个观众消耗 1 份下行(等于当前清晰度码率),由 CDN 分发承载。主流云直播平台的 CDN 天然支持十万级并发,这部分压力由平台承担。
真正需要向平台确认的是三件事:套餐并发上限、超额后的计费方式、卡顿率 SLA。自建源站的场景除外——自建时要按"峰值并发 × 观众码率"计算出口带宽,例如 720 人 × 2Mbps ≈ 1.5Gbps 出口,这正是大多数自建方案在几百并发后就崩溃的原因。
四、压测怎么做:阶梯加压 + 三个指标
估算是纸面功夫,开播前一周要做一次实测。压测分两端:
推流端压测:在正式推流网络下,用另一台设备拉流观看,连续跑 30 分钟。看推流软件的丢帧率是否持续为 0、拉流端画面是否稳定。上行不稳在这一步就会暴露。
观众端压测:用压测工具模拟批量观众拉流,按预估峰值的 20% → 50% → 80% → 100% 四档阶梯加压,每档持续 10 分钟,记录三个指标:
| 指标 | 合格线 | 异常时排查方向 |
|---|---|---|
| 首帧时间 | < 3 秒 | GOP 过长、播放器缓冲设置、CDN 调度 |
| 卡顿率 | < 2% | 并发上限、节点覆盖、清晰度档位过多 |
| 推流丢帧率 | 0 | 与观众端无关,是推流端上行问题 |
没有专业压测工具时,最低限度也要组织 20–50 人内部彩排走完全流程:登录、观看、清晰度切换、弹幕互动、答题、回放。真实用户暴露的问题(尤其是企业微信/小程序内嵌的白屏、权限问题)比模拟压测更有价值。
五、常见场景的并发量级参考
| 场景 | 典型峰值并发 | 关键约束 |
|---|---|---|
| 企业年会(全员) | 500–5000 | 同时段全员涌入,峰值尖锐,预案要足 |
| 学术会议 / 医院示教 | 100–2000 | 分院/科室分点观看,注意内网出口带宽 |
| 企业培训(分批) | 50–500 | 可控调度,优先保清晰度与互动 |
| 电商直播 | 1000–50000 | 流量受投放影响波动极大,必须按投放量上浮 3–5 倍估算 |
| 连麦/圆桌互动 | 房间内 20–200 | RTC 模型,与观看并发完全不同,单独评估 |
连麦场景要特别提醒:它按 RTC 房间模型计算,与"能扛多少观众"不是一个概念,方案里要分开写清楚。
六、超出承载的分级预案
开播后在线曲线冲破预估是常事,预案按影响从小到大分四级:
- 降互动:关闭弹幕、答题等非必要互动,降低服务端压力,画面不受影响。
- 降档位:下架 1080p 档,只保留 720p 及以下。观众感知小,单观众带宽省一半。
- 临时扩容:联系平台方提升并发上限或切换计费模式。主流平台都支持,但要提前确认好响应时长——这是开播前就该留好的联系方式。
- 分流:启用备用频道,主持人现场口播引导一半观众切换。最重手段,通常用不到,但必须有。
直播结束后的复盘动作:导出并发曲线与卡顿率曲线,和报名数据对照,修正下一次的到场率系数。估算模型的精度就是这样一场一场磨出来的。
常见问题
经验公式是:报名数 × 到场率 × 同时在线率。免费或内部场次到场率通常 30% 到 60%,付费或强通知场次可到 60% 到 80%;开播 10 分钟后在线人数通常回落到峰值的 80% 到 95%。例如报名 1000 人、到场率 50%、同时在线 90%,峰值并发约 450。
观众侧走 CDN 分发,源站推流只占用上行(例如 1080p 4Mbps 一条固定上行),观众增长不会直接压垮推流端。带宽压力主要在 CDN 侧,主流云直播平台的 CDN 天然支持十万级并发,真正要先确认的是所购套餐的并发上限和超额计费方式,而不是自建带宽。
分两端压:推流端用本地拉流比对验证上行稳定;观众端用压测工具模拟批量拉流地址,按 20%、50%、80%、100% 预估峰值分四档阶梯加压,每档持续 10 分钟,观察首帧时间、卡顿率、丢帧率三项指标。没有压测工具时,至少组织 20 到 50 人内部彩排走完全流程,覆盖登录、观看、互动、回放。
普通观看是单向分发,每人只消耗下行带宽;连麦是双向实时通信,每个连麦者要同时上行自己的画面并下行其他人的画面,房间内人数越多每人消耗越大,且受 RTC 房间人数上限约束。普通直播能扛十万观众,连麦房间通常几十人到几百人量级,两者不能按同一个模型估算。
分级处理:先关闭非必要互动(弹幕、答题)降低服务器压力;若平台控制台显示逼近套餐并发上限,联系平台方临时扩容或切换计费模式;仍不足时把观众分流到备用频道,或把最高清晰度下架只保留 720p 以下档位。这些预案要提前写入执行手册,现场再想来不及。
主流云直播平台控制台都有实时监控:看在线人数曲线、峰值并发、卡顿率和区域分布四个指标。卡顿率超过 2% 就要警觉,结合区域分布判断是某些地区节点问题还是整体承载问题。直播结束后导出并发曲线,和报名到场数据对照,下一次活动的估算会更准。
📚 👉 延伸阅读:直播推流参数配置指南(码率/分辨率/帧率)
📚 技术实操系列