1.
需求評估與目標設定
需求界定:確定業務系統的RTO與RPO目標。
流量分析:統計每日峰值與常態帶寬,例:峰值3Gbps、平均200Mbps。
資產識別:列出關鍵服務(Web、DB、API、存儲)與依賴關係。
風險評估:評估自然災害、網路中斷、機房停電等風險概率。
合規需求:考量資料主權與備份保存天數(例如7天快照、30天冷備)。
2.
跨機房架構設計
主從部署:主機房(台北)為讀寫主節點,備機房(高雄)為熱備或冷備。
負載分擔:前端使用HAProxy/NGINX做健康檢查與會話保持。
DNS與Anycast:採用短TTL與Anycast路由,必要時手動切換A記錄或使用DNS failover。
同步方式:資料庫採主從複製(MySQL GTID 或 PostgreSQL streaming replication)。
網路互連:機房間採MPLS或專線VPN,目標延遲<20ms、丟包<0.1%。
3.
備份策略與技術手段
備份分類:熱備(即時複製)、冷備(定期快照)、異地備份(對象存儲)。
快照頻率:例:每小時快照保留24小時、每日快照保留30天。
增量與全備:每日採增量備份、每週做一次全量備份以降成本。
存儲位置:備份上傳至公有雲對象儲存(S3兼容)與另一機房的NAS。
驗證還原:每月演練還原,記錄RTO實際值並與目標比較。
4.
DDoS 與CDN防護設計
邊界防護:部署專用DDoS防護設備或使用Cloudflare/阿里雲防護。
流量清洗:當入站流量超過閾值(如500Mbps)時,觸發流量引導至清洗中心。
CDN加速:靜態資源走CDN,減少源站負載並降低延遲。
BGP Anycast:對外IP使用Anycast,提升多點接入與抗攻擊能力。
監控告警:設置流量、連線數及錯誤率告警,閾值與持續時間可自定義。
5.
真實案例:某台灣電商平台跨機房容災
案例背景:某電商在台北主機房與高雄備援機房運行,流量季節性波動大。
配置摘要:台北主DB:Intel Xeon 8C/16T, 64GB RAM, 2x1TB NVMe RAID1, 1Gbps;高雄備DB:6C/12T, 32GB, 1TB NVMe, 1Gbps。
切換流程:主機房故障時,自動Promote備機(使用Pacemaker+Corosync),DNS TTL=60s縮短切換時間。
演練結果:一次演練RTO 6分鐘、RPO 5分鐘,峰值流量切換無明顯錯誤。
改善項目:加入CDN更多POP,並且將寫入密集型服務拆分至專用主機。
6.
配置範例與成本估算
下表示範兩套常見的台灣物理VPS配置與月費估算:
| 機房 | CPU / RAM | 儲存 | 頻寬 | 月費估算 |
| 台北(主) | 8C/16T, 64GB | 2x1TB NVMe | 1Gbps 不限流量 | NT$18,000 |
| 高雄(備) | 6C/12T, 32GB | 1TB NVMe | 1Gbps 1TB/月 | NT$9,000 |
結論:依業務重要度選擇熱備或冷備,設定合理RTO/RPO並持續演練與監控,結合CDN與DDoS防護可大幅提升台灣地區VPS跨機房容災能力。
来源:容灾与备份 台湾物理机构vps 跨机房容灾设计方法