导语:前面《分布式(一)》讲过"脑裂与多数派仲裁"的理论(第 10 题),《Redis(三)》讲过缓存与集群的自动故障转移。本篇把视角拔到机房级容灾:RTO/RPO 怎么定、同城双活与异地多活怎么选、异地多活的核心难点与单元化改造、多机房数据同步与冲突解决、流量调度与"一键切流"的坑、容量水位与容灾演练,共 9 题。
2026/8/5大约 12 分钟
导语:前面《分布式(一)》讲过"脑裂与多数派仲裁"的理论(第 10 题),《Redis(三)》讲过缓存与集群的自动故障转移。本篇把视角拔到机房级容灾:RTO/RPO 怎么定、同城双活与异地多活怎么选、异地多活的核心难点与单元化改造、多机房数据同步与冲突解决、流量调度与"一键切流"的坑、容量水位与容灾演练,共 9 题。
导语:高可用的第一原则是「承认故障必然发生」。本篇围绕流量治理这套组合拳展开:限流(算法选择、单机 vs 分布式、放在哪层、阈值怎么定)、熔断(状态机、Sentinel 与 Hystrix 的分野、隔离方式)、超时(最容易被忽略却性价比最高)、降级(分级预案、开关、演练),共 10 题。