IT团队常常意识到带宽对存储的影响,但许多团队未能正视和量化这一问题。这包括了WAN性能不佳带来的隐性代价。当备份副本、远程复制和灾难恢复流程因延迟和丢包而变慢时,问题不仅限于漏接传输速度。它影响更大的基础设施支出,增加备份窗口,导致过度配置连接、延迟恢复以及更高的运营风险。监管合规也可能失败。
那么,答案是什么?其实,很多时候大家的想法是,如果带宽导致瓶颈,那答案就是买更大的管道来减少瓶颈。接着是添加新硬件,可能需要应对数据流量的增加;也许最糟糕的行为——也是维护服务连续性和合规性最危险的措施之一——就是放宽恢复预期。这根本不该被考虑。
数据传输低效
真正的问题实际上是未加速的广域网在传输和接收大距离数据时所带来的低效。数据传播距离越远,延迟和丢包的影响就越严重。因此,我们需要再次审视如何利用现有的设备提升带宽利用率,并以一种让数据能够跨越长距离传输而不受延迟和丢包影响的方式来实现。
Marc Rupprecht为Paessler PRTG撰写的文章(最后更新于2025年11月13日)正确地评论道:“你可能花了比你愿意更多的时间排查网络问题。最糟糕的是?终端用户并不关心你的路由器设置或带宽。他们只关心事情应该快速运作,但往往并非如此。”他随后解释了为什么不仅仅是增加带宽。
“关于网络延迟,问题并不总是要投入更多带宽。我们与那些网络拥有千兆对称互联网但用户响应时间较慢的客户合作。我们看到低吞吐量连接的客户端,却始终实现低延迟。理解它们的区别并知道该操作哪些杠杆,可以帮你节省无数小时的排查,并在关键领域真正提升应用性能。”
探索各种选项
那么,存储团队在想要应对和减轻延迟和丢包影响时可以做些什么呢?WAN 优化是一个选项,但它无法发送和接收加密数据。还有SD-WAN,但它们通常需要提升,这通常通过创建WAN加速覆盖层来实现。WAN加速是一种技术,不要与WAN优化混淆,后者通过部署人工智能、机器学习和数据并行化,提高数据传输速率,并在无需购买新设备的情况下提升带宽利用率,从而提升高达98%的带宽利用率。
正如几个月前我在贸易展博客Cloudfest提到的《云延迟与数据包丢失指南:如何修复它们?》——由自由职业商业与科技记者Graham Jarvis撰写——同样需要考虑集中企业业务和服务连续性能力的影响。通过将这些设施置于相同的干扰圈中以降低延迟,当这些非常重要的设施在同一本地遭遇网络攻击或停电等问题时,就会面临危险。它们可能会影响正常运行时间。
延迟和丢包损害
“丢包在加密通信或金融交易中尤为严重,缺失数据可能触发重传或会话失败,损害性能和信任,”Niksun在其博客《延迟、抖动与丢包:定义网络性能管理的关键指标》中写道。
“在同一数据中心或影子中心内托管仍然是个问题。有时通过将数据中心一分为二创建故障切换区,但只有双方都不断电时才没问题。如果你真的想拥有一个安全的灾难恢复系统,你需要采用3-2-1-1-0的方法。”
Jarvis写道:“WAN Acceleration可以发送和接收大量加密数据。它也是数据中立的,像Bridgeworks这样提供该服务的公司无法察觉这一点。”然而,挑战往往在于合规性——将灾难恢复站点和数据中心推得更近,以确保符合其他考量。
监管问题
文章中,他指出欧盟的云主权框架可能要求数据存储在国家或区域范围内。尽管有这些要求,距离仍有其优势——尤其是当数据中心和灾难恢复站点位于遥远且超出各自中断范围时。问题在于,数据传输距离越远,延迟问题就越大。目前,最快实现这一点的方式是WAN Acceleration。
因此,WAN Acceleration 的作用是加快数据传输并保护数据,同时提升异地备份和远程复制的效率。另一种选择不值得自满。Niksun在其博客中解释道:“延迟、抖动和丢包不仅影响用户体验;它们直接影响业务连续性。在线客服会话中出现高数据包丢失或CEO网络直播中出现严重抖动,都可能损害品牌信誉。此外,这些问题往往暗示着更深层的漏洞——比如配置错误或潜在的安全威胁。”
降低总存储和网络成本
值得庆幸的是,WAN 加速可以降低总存储和网络成本,同时提升 RPO 和 RTO。一家F1公司、一家家喻户晓的网络安全公司,以及像Veeam这样的公司,都体验到了其带来的改进带来的好处。
这包括更快的备份和恢复——使得在自然灾害、网络灾害或人为灾难发生时,业务和服务的连续性更加可能。因此,这种方法不再将广域网视为固定限制,而是能释放现有存储和备份投资的更好回报,使备份和复制中的广域网性能不佳成为过去。