收藏本站 网站导航 开放平台 Wednesday, September 9, 2026 星期三
  • 微信

ChatGPT 、 Claude 、 Grok 集体掉线,为啥都怀疑 Cloudflare ?

来源 中金网 23小时前
摘要: 既是互联网宕机的「背锅侠」,也是 AI 时代被容易被忽视的「铲子」。

  既是互联网宕机的「背锅侠」,也是 AI 时代被容易被忽视的「铲子」。

  9 月 3 日晚,ChatGPT、Claude、Grok 三家头部 AI,几乎同一时间掉线。

  小声吐槽:现在连宕机都有「新御三家」了,Gemini 已经排不上号了么。

  更有意思的是,出事以后,不少人的第一反应,是去看 Cloudflare、AWS 和 Azure 的状态页,尤其是 Cloudflare。

  只不过,这次锅似乎还真轮不到它背,Cloudflare 状态页并未出现全球性重大事故,目前也没证据表明三家的故障来自同一个源头。

  于是问题反而变得更有意思,为什么现代互联网一旦出现大面积服务异常,Cloudflare 总是最先被怀疑的那几个名字之一?

  特别是这次明明不是它,但所有人第一时间想到它,本身就说明了很多。

  一、为什么一宕机,都想到 Cloudflare?

  很多人最早认识 Cloudflare,可能还是因为 CDN、网站加速,或者 DDoS 防护。

  但如果今天还只把它理解成一家 CDN 公司,已经有点过时了。

  我们日常打开一个网站,看起来无非是「用户 → 网站」。

  真实世界里,中间那条链路要复杂得多,更接近于「用户 → 域名 → DNS → Cloudflare → CDN WAF DDoS 身份验证 边缘计算 → 网站服务器」。

  也就是说,Cloudflare 并不一定拥有你最终访问的那个网站,却可能站在你和网站之间:

  • 网站希望打开得更快,要经过它;
  • 被 DDoS 攻击,希望有人挡在前面,要靠它;
  • API 请求、机器人流量、企业员工访问内部系统,要经过它;
  • 开发者开始把程序直接跑在边缘节点上,又有 Workers;
  • 到了 AI 时代,模型 API、AI Gateway、Agent、MCP,Cloudflare 也开始往这一层延伸;

  Cloudflare 自己现在对外的定位,就是一套服务于 apps、agents 和 workforce 的统一平台,而我觉得,把 Cloudflare 理解成互联网的「水电煤」,可能更准确。

  平时完全感觉不到它,网页正常打开,API 正常返回,恶意流量在后台被拦掉,但只要一出问题,所有网站会突然一起挂掉。

  对一家基础设施公司来说,这是个很奢侈的位置。

  关注官方 X,获取美股资讯

  二、Cloudflare 宕机,半个互联网一起报错?

  当然,位置越重要,出错的代价也越大。

  回头翻 Cloudflare 的宕机史,几乎是一部现代分布式网络的故障警示录。

  2019 年,一条 WAF 安全规则里的正则表达式出了问题,迅速把处理 HTTP 流量的 CPU 打满,最后核心代理、CDN 和 WAF 一起受到影响,整个互联网开始出现大量 502。

  2022 年,一次网络配置调整出了问题,影响了 19 个数据中心,且恰好是最繁忙的一批节点,一度波及了约 50% 的请求量。

  到了 2025 年,Cloudflare 自己的产品越来越多,事故也开始出现「内部传染」。

  先是 6 月,Workers KV 所依赖的底层存储基础设施发生故障,结果 WARP、Access、Gateway、Workers AI、Turnstile 等一串服务一起被带下去,持续了两个多小时。

  更夸张的是 11 月,一次数据库权限修改,导致 Bot Management 使用的一个配置文件突然膨胀到原来的两倍,又被同步到了大量机器上,最后直接把核心网络流量搞出了问题。

  以至于 Cloudflare 一开始甚至以为自己遭遇了超大规模 DDoS,排查以后才发现是自己生成了一个太大的文件......

  说到底,真正把小错误放大的,是 Cloudflare 所处的位置,它已经嵌进了太多网站、应用和服务的必经之路。

  加入官方社群,讨论热点话题

  三、NET:AI 时代最容易被忽视的「铲子」

  不过,如果把 Cloudflare 看成一家「很重要的互联网基础设施公司」,其实也少看了一层。

  过去几年,它的业务路径越来越清晰:从 CDN、DNS 和 DDoS 防护,往 Zero Trust、网络安全、Workers 开发平台不断扩张,现在又开始把 AI Gateway、Workers AI 和 Agent 基础设施接进来。

  而 AI,可能正在让它原本就很关键的位置变得更值钱。

  原因并不复杂——Agent 越多,网络请求越多,身份越多,安全需求也越多。

  这和传统 SaaS 的逻辑还不太一样,以前互联网主要是人访问机器,一个人打开网页、点几个链接、看完退出,一天下来的请求量终归有限。

  Agent 完全不是这么回事,它为了完成一个任务,可能连续搜索几十个页面,调用几个 API,背后可能变成几十、几百次机器调用。

  如果未来越来越多互联网流量真的从 Human-to-Machine,变成 Machine-to-Machine,那 Cloudflare 就是它们运行的平台,也是它们需要经过的网络,理论上只会越来越忙。

  最新财报也验证了这个趋势,Q2 营收达到 6.96 亿美元,同比增长 36%,且增速是从去年四季度和今年一季度的 34% 左右继续往上走的。

  对一家年收入已经超过 20 亿美元的公司来说,这种体量还能重新加速,本身就不容易,这也是为什么 8 月初财报出来以后,NET 一度冲到 330 美元上方。

  不过,基本面很好,但市场也已经知道它很好,因此 8 月高点之后,股价一度回落不少。

  那接下来就看,Agent 带来的机器流量、安全需求和开发平台收入,能不能跑得足够快,继续消化今天已经很高的预期。

  写在最后

  昨晚 ChatGPT、Claude 和 Grok 集体故障,虽然不是 Cloudflare 导致的。

  但这个乌龙本身,反而很适合拿来认识 Cloudflare。

  我们平时看到的都是最上面那一层,今天是 ChatGPT,明天是 Claude,再过几年,也许又换成一批新的 Agent。

  应用会换,入口也会换。

  但只要它们还需要联网,需要访问数据,需要验证身份,需要调用 API,也需要有人挡住攻击,下面那层基础设施就不会凭空消失。

  甚至,机器越多,这一层可能越忙。

  Cloudflare 押的,大概就是这件事。

免责声明:中金网发布此信息目的在于传播更多信息,与本网站立场无关。中金网不保证该信息的准确性、真实性、完整性、有效性等。相关信息并未经过本网站证实,不构成任何投资建议,据此操作,风险自担。