
今天上午, Cloudflare的基礎設施發生大範圍故障,導致西班牙數百萬用戶無法存取多個網路服務。受影響的平台包括X 和 ChatGPT,以及其他一些高流量工具和網站。
症狀表現為500錯誤、載入時間極長以及路由無回應。這次事件凸顯了全球網路基礎設施對少數關鍵服務供應商的依賴性,這些服務供應商既是網路流量的保護屏障,也是加速器。
事件的時間順序和範圍
根據監測服務顯示,故障報告在西班牙半島時間下午 12:30左右開始增加。下午 12:48,Cloudflare 確認了這起事件並啟動了調查程序。從下午 13:15開始,許多服務開始逐步恢復,但可能仍存在一些遺留問題。
根據與專業媒體的溝通顯示,上午11點20分左右,公司內部出現異常流量高峰,導致多項服務間歇性故障。公司強調,此次流量激增的原因仍在調查中,同時優先保障全球網路的全面穩定。
受影響的平台和產業
社群網路X在多個地區遭遇嚴重故障,使用者無法載入資訊流或發佈內容。 ChatGPT也出現了異常行為和間歇性無法存取的情況,反映出此次故障的影響範圍之廣。
這次故障影響了其他熱門服務:Canva 、 《英雄聯盟》遊戲以及Shopify、Dropbox和Coinbase等公司都報告了故障。甚至像穆迪這樣的企業入口網站和新澤西州公共交通公司(NJ Transit)這樣的交通服務也報告了錯誤,這表明此次故障波及多個領域。
在西班牙語和歐洲地區,用戶報告Menéame等主流入口網站出現故障,以及一些頗具諷刺意味的情況,例如Downdetector也出現錯誤,而Downdetector同樣依賴Cloudflare的基礎設施。在西班牙,一些Caixabank的客戶報告在高峰時段遇到網路連線問題。
Cloudflare 的公告及其當前狀態
該公司最初將該事件定性為服務降級,出現 500 個錯誤,並導致控制面板和 API 中斷。該公司立即實施了緩解方案,並透過狀態頁面發布了進度更新。
作為臨時措施,Cloudflare暫時關閉了英國部分用戶的Access 和 Warp 服務以穩定網絡,並在數小時後宣佈在倫敦重新啟用該服務。該公司警告稱,即使恢復工作正在進行中,在變更生效期間,錯誤率仍可能高於正常水平。
官方更新資訊發佈在cloudflarestatus.com,待穩定後,將在blog.cloudflare.com上發布詳細的技術分析。根本原因尚未公開完全解釋,目前仍在調查中。
對西班牙和歐洲的影響
在西班牙,網路中斷最嚴重的時期出現在中午前後(伊比利半島時間),使用者無法存取社群媒體、辦公室工具和網路銀行服務。隨著下午時間的推移,問題逐漸緩解,但仍有一些用戶遇到輕微的網路中斷。
在歐洲,此故障影響了多個國家,其中英國採取的具體措施包括暫時停用部分網路上的 WARP 和 Access 服務。恢復工作逐步進行,據 Cloudflare 稱,在採取緩解措施後,大部分流量已恢復正常。
關於數位韌性的經驗教訓
本事件凸顯了當中心服務提供者發生故障時,整個生態系統的脆弱性。此外,先前AWS和Azure也相繼發生故障,這更加強調了實施業務連續性策略以及在可行的情況下跨多個服務提供者進行負載平衡的重要性。
對於企業而言,加強網路級冗餘(多 CDN)、建立故障轉移路由以及與客戶和內部團隊保持溝通計劃,是最大限度減少此類事件影響的關鍵。
使用者可以做什麼
如果發生大規模服務中斷,建議查看服務狀態頁面,避免進行重大更改,幾分鐘後重試訪問,不要在承諾提供臨時「解決方案」的可疑網站上洩露憑證。
如果您依賴雲端工具處理敏感任務,最好準備本地或第三方替代方案,並建立離線操作流程,直到服務恢復正常。
Cloudflare的服務中斷導致X和ChatGPT等服務在西班牙中午部分時間無法使用,並對多個行業造成了連鎖反應。目前服務恢復工作正在進行中,調查也正在進行中。這次事件再次凸顯了企業和使用者對技術彈性和緊急應變計畫的需求。

