美国蜂窝网络中断影响 AT&T、T-Mobile 和 Verizon 用户

美国范围内的一次大规模 AT&T 蜂窝网络中断让许多用户只能使用“仅 SOS”服务,扰乱了部分 911 和 FirstNet 紧急通信,并引发混乱:官方状态页起初显示没有问题,而 Downdetector 等网站上的报告却激增。评论者围绕可能原因展开争论——从共享电信基础设施和失误的软件或网络更新(后被 AT&T 提及)到太阳耀斑或网络攻击这类不太可能的说法——并将此事件与加拿大 Rogers 等以往大规模中断进行比较。此次事件也凸显了基于短信的身份验证的脆弱性、状态页的模糊与营销式表述,以及关键通信基础设施的整体脆弱性,而社会越来越依赖它来完成日常导航、支付和紧急响应。

中断的范围与症状

  • 美国各地许多 AT&T 客户报告称出现“仅 SOS”、通话失败、短信问题以及无法使用的移动数据;Wi‑Fi 通话往往仍可正常工作。
  • 影响并不一致:同一家庭套餐中的部分手机、同一辆车里或同一所房子里的部分手机有服务,而其他手机没有。
  • 报告提到实体 SIM 与 eSIM 之间的差异,以及 LTE 与 5G 之间的差异,但这些模式都只是零散传闻,且不一致。
  • 一些使用 AT&T 网络的 MVNO 没受影响,另一些则完全中断。
  • Downdetector 和类似网站在多个运营商上都显示出激增,但若干评论认为,这很可能反映的是人们无法拨通 AT&T 用户,而不是真正的多运营商中断。
  • 时间上:许多人注意到问题大约从当地时间凌晨 3–4 点开始,数小时后部分恢复,并且按地区/设备分批恢复。

原因与技术推测

  • 早期推测从 SS7 问题、BGP 配置错误、共享硬件/软件缺陷,到太阳耀斑或网络攻击都有。
  • 几位有电信经验的评论者强调,全国性问题可能源于平常的配置错误、路由变更,或核心设备上的软件更新。
  • 在讨论后期,引用了 AT&T 的公开说法(通过新闻报道):这是一次软件更新 / “不正确流程”在网络扩展期间造成的问题,不是网络攻击。
  • 文中提到一些关于 Cisco 以及存有 SIM/授权数据的核心数据库的说法,但这些只是传闻;细节仍不明确。

紧急服务与关键基础设施

  • 据报一些 AT&T 用户即使手机显示“仅 SOS”,也无法拨通 911。
  • 另一些人表示,原则上紧急呼叫应可回落到任何可用网络,但也承认这取决于故障模式,可能会失效。
  • 关于 FirstNet(公共安全网络)的说法相互矛盾:有人说 AT&T 表示其未受影响,而 911 中心的其他人报告称 FirstNet 设备掉线、失去移动服务。

状态页、监控与透明度

  • 对运营商状态页的批评很强烈:在明显的全国性事件期间常常显示“一切正常”,或者更新很晚且措辞含糊。
  • 有人认为第三方监控(如 Downdetector、ThousandEyes)如今比官方页面更有用;也有人指出这些工具有局限性,并带有用户感知偏差。
  • 人们希望有更好、自动化、按客户细分的影响仪表板,以及真正的事后总结;但也怀疑大型电信公司是否会发布有意义的 RCA。

更广泛的反思:可靠性、设计与政策

  • 讨论了社会对蜂窝网络的依赖程度——用于 2FA、支付、导航、物流和公共安全。
  • 呼吁:
    • 减少基于短信的 2FA。
    • 更多采用先离线(offline-first)的应用设计和离线地图。
    • 加强对中断报告和 911 可靠性的监管。
  • 有人将过去贝尔系统的可靠性、以及去中心化和容错设计,与当今更复杂、中心化、由软件驱动的核心网络进行了对比。