跳转到内容
搜索文档

参考信息

最后更新 查看 MarkdownAgent 设置

如果用户能够连接到 Cloudflare,且其连接的站点启用了 NEL,Cloudflare 会向浏览器传递两个标头,指示浏览器遇到任何网络故障时将其报告给标头中指定的端点。浏览器将照常运行,如果发生阻碍浏览器连接到站点的事件,浏览器将把故障记录为报告并发送给该端点。

Network Error Logging 故障可能因不同原因而发生,具体概述如下。

互联网服务提供商 (ISP) 故障

ISP 故障在 NEL 用户看来是来自某一个特定最后一公里网络的故障。通过查看 NEL 数据并观察客户端自治系统号 (ASN) 视图,你可以了解哪些网络造成的影响最大。

对于客户而言,此场景表现为大量涌入的 tcp.timed_out 错误,以及 tcp.failedh2.protocol_errorh3.protocol_error

如果发生最后一公里故障,最佳做法是联系提供商进行排查。

传输抖动 (Transit Flap)

传输抖动看起来像是因传输重新建立 BGP 会话而导致的暂发性故障。

对客户而言,这将在短时间内表现为来自各种 ASN 的 tcp.timed_out 报告。发生这种情况可能出于以下原因:

  • 传输网络中的维护需要重置会话。
  • Cloudflare 中的维护或重启需要重置 BGP 会话。
  • 网络中的丢包导致会话抖动。

网络中的严重丢包可能会导致随时间推移发生一系列抖动。维护通常是一个持续不超过两分钟的影响期。

基础设施故障 (Infrastructure outage)

基础设施故障发生在共享对等互联节点,例如互联网交换中心 (IX)。

这些故障在客户看来表现为 tcp.timed_outtcp.failedtcp.aborted 报告的激增。这些故障可能会在较长时间内跨多个网络呈现。

根据报告数量的严重程度,Cloudflare 可能会声明事件以跟踪修复情况。或者,Cloudflare 可能会暂停来自这些共享节点的对等互联,直至问题解决。

Cloudflare 故障

Cloudflare 故障由 Cloudflare 数据中心内部架构的问题构成。

这些故障在客户看来表现为 tcp.timed_outtcp.failedtcp.aborted 报告的增加,且可能会在短时间内跨多个网络呈现。

通过按数据中心进行透视,客户可以跟踪跨 Cloudflare 节点 (PoP) 的影响。基于 Cloudflare 的事件始终会通过状态页面进行跟踪,该页面将指示受影响区域内是否存在问题。

提供商通过清洗中心发送流量/封锁流量

此类故障表现为 TLS 错误(例如 tls.cert.authority_invalidtls.cert.name_invalid 或其他),并且还可能伴随 tcp.aborted 错误。

客户可以通过查看哪些最后一公里 ASN 正在显示异常增多的故障来揭示此行为,因为通常只会有一个 ASN 受到影响。

客户可以通过联系他们认为正在清洗其流量的提供商来寻求修复。

证书问题

证书问题也可以通过 NEL 进行检测。TLS.versioncipher_mismatch 或其他错误可能会跨多个 Cloudflare 位置中的多个 ISP 呈现。

如果在 NEL 中检测到此情况,可以通过部署新证书或使用 Cloudflare 的 SSL 管理套件 自动部署新证书来修复该问题。

这篇文档对您有帮助吗?