应急切换演练
导语:链路断了、核心挂了、机房淹了——预案写在文档里不算数,真正能切换才算。应急切换演练把"纸面预案"变成"肌肉记忆",暴露设计盲点。
一、为什么要关注
- 未演练的预案往往有隐藏断点(路由、ACL、DNS);
- 真实故障下人的紧张会放大失误;
- 等保与业务连续性要求定期演练并留痕。 演练是检验网络可靠性的唯一标准。
二、核心原理(多厂商客观对比)
演练围绕"故障注入→检测→切换→回切"闭环,依赖 BFD、路由优先级、VRRP 等机制,厂商无关。
| 环节 | 华为 | 新华三 H3C | 锐捷 | 思科 | 迈普/信创 |
|---|---|---|---|---|---|
| 检测 | BFD | BFD | BFD | BFD | 国产探测 |
| 切换 | 路由/VRRP | 路由/VRRP | VRRP | 路由 | 国产机制 |
| 回切 | 手动/自动 | 手动/自动 | 手动 | 手动 | 手动 |
三、落地做法/步骤(各厂商命令语法略有差异,以下为通用思路)
- 定场景:断上行、断核心、断专线;
- 选窗口,通知相关方,备回退方案;
- 注入故障,记录检测与切换耗时;
- 验证业务(含备份任务)正常;
- 回切并复盘,更新预案。 通用建议:每次只演练一个变量,结论才清晰。
四、网络如何为数据存储/备份提供安全底座
五、常见误区
- 只演练不回切,环境留下脏状态;
- 多变量同时注入,定位不到真问题;
- 演练不记录,复盘无依据。
六、小结与行动建议
演练 = 单变量 + 可回退 + 留痕复盘。把存储备份链路切换纳入固定演练清单,确保灾时"数据不丢、切换可控"。