Cloudflare mengalami gangguan perkhidmatan yang meluas pada 18 November 2025, bermula kira-kira 11:20 UTC. Gangguan itu menjejaskan sebahagian besar trafik internet global dan menyebabkan gangguan perkhidmatan merentas platform utama, termasuk ChatGPT, Claude, Spotify, X dan HostScore.net. Kegagalan itu membawa kepada ralat HTTP 5xx yang berterusan, aliran pengesahan yang rosak dan kependaman yang tinggi dalam Cloudflarerangkaian.
Cloudflare kemudian mengesahkan bahawa kejadian itu bukan disebabkan oleh serangan siber, walaupun spekulasi awal disebabkan oleh skala dan gejala kegagalan. Pengumuman ini berfungsi sebagai kemas kini rasmi untuk pembaca, rakan kongsi dan pihak berkepentingan kami semasa kami mendokumentasikan perkara yang berlaku, cara ia merebak dan cara perkhidmatan akhirnya pulih.
Skop Gangguan
Gangguan itu menyebabkan Cloudflareteras CDN dan lapisan keselamatan untuk menghentikan pemprosesan trafik seperti biasa, yang membawa kepada peningkatan mendadak dalam ralat HTTP 5xx merentas rangkaian. Pelawat ke tapak web yang terjejas mengalami halaman ralat, beban terhenti atau kelewatan yang lama CloudflareLapisan proksi bergelut untuk bertindak balas. Perkhidmatan utama termasuk Pengurusan Bot, Turnstile, KV Pekerja dan Cloudflare Akses terdegradasi pada masa yang sama. Kesannya bertambah pada laman web yang bergantung kepada Cloudflare untuk caching, keselamatan dan pengesahan.
CloudflarePapan pemuka juga sukar diakses kerana Turnstile, lapisan pengesahan pada halaman log masuk, gagal dimuatkan. Halaman status yang dihoskan secara luaran syarikat turut berada di luar talian, yang menimbulkan kekeliruan pada minit awal kejadian. manakala Cloudflareinfrastruktur e-mel terus beroperasi, ketepatan pengesanan spam merosot seketika disebabkan kehilangan suapan reputasi IP.
Punca Punca: Pepijat Terpendam
Cloudflare mengesahkan bahawa gangguan itu dicetuskan oleh pepijat terpendam dalam komponen teras sistem Pengurusan Botnya.
Pada 11:05 UTC, kemas kini kebenaran pangkalan data rutin secara tidak sengaja mengubah cara perkhidmatan penjanaan ciri membuat pertanyaan metadata. Daripada menarik daripada skema tunggal, perkhidmatan mula menanyakan kedua-dua skema lalai dan r0, menghasilkan satu set besar baris ciri pendua. Fail konfigurasi kembung ini kemudiannya disebarkan ke seluruh Cloudflarerangkaian global.
Enjin proksi teras menguatkuasakan had keras 200 ciri pembelajaran mesin untuk prestasi dan peruntukan memori. Fail bersaiz besar melebihi had ini, menyebabkan proksi FL2 panik dan mengembalikan ralat 5xx untuk semua permintaan yang terjejas. Pelanggan yang masih menggunakan enjin FL yang lebih lama tidak gagal secara langsung, tetapi markah Pengurusan Bot mereka menjadi sifar, yang membawa kepada pengendalian trafik yang tidak konsisten.
Garis Masa Resolusi
Cloudflare mengesan gelombang pertama ralat dalam trafik pelanggan pada 11:28 UTC.
Jurutera pada mulanya menumpukan pada Workers KV, yang menunjukkan penurunan tidak normal dalam kadar tindak balas antara 11:32 dan 13:05 UTC.
Pada 13:04 UTC, Cloudflare menggunakan tampung kecemasan untuk memintas proksi teras untuk Workers KV, diikuti dengan pintasan serupa untuk Cloudflare Akses pada 13:05 UTC.
Menjelang 13:37 UTC, pasukan kejuruteraan mula melancarkan semula konfigurasi Pengurusan Bot kepada versi yang terkenal.
Cloudflare menghentikan penciptaan fail ciri baharu pada 14:24 UTC dan menggunakan konfigurasi yang diperbetulkan secara global pada 14:30 UTC, yang memulihkan aliran trafik normal.
Isu log masuk papan pemuka dikosongkan kemudian, dengan akses panel kawalan penuh dipulihkan sekitar jam 15:30 UTC. Cloudflare menandakan kejadian itu diselesaikan sepenuhnya pada 17:06 UTC.
HostScore.net Kenyataan Kesan
HostScore.net adalah antara tapak yang terjejas semasa tingkap terputus. Pasukan kami melihat lonjakan serta-merta dalam respons 5xx dan ketidaktersediaan sementara sebagai Cloudflare's CDN dan lapisan keselamatan gagal memproses permintaan. Pemulihan tapak berlaku secara beransur-ansur sebagai Cloudflare melaksanakan langkah pemulangan dan pemulihannya.
Sistem pemantauan kami mengesan isu ini dalam beberapa minit dan kami meneruskan penjejakan kelakuan rangkaian sehingga kestabilan penuh kembali. Walaupun gangguan itu berpunca daripada infrastruktur kami, kami tetap komited terhadap ketelusan dan akan terus menambah baik proses pemantauan dan kontingensi kami untuk mengukuhkan daya tahan perkhidmatan secara keseluruhan.
CloudflarePengakuan dan Tindakan Selepas Insiden
Cloudflare secara terbuka mengakui keterukan kejadian itu, dengan CTO Dane Knecht mengeluarkan permohonan maaf dan menyatakan bahawa syarikat itu "menggagalkan pelanggannya dan internet yang lebih luas." Syarikat itu menyifatkan acara itu sebagai gangguan yang paling serius sejak 2019, menekankan bagaimana ralat konfigurasi kecil boleh mengalir melalui sistem pengedaran berskala besar.
Cloudflare telah mula bekerja pada beberapa penambahbaikan jangka panjang, termasuk mengeraskan proses pengingesan untuk fail konfigurasi yang dijana secara dalaman, mengembangkan suis bunuh global untuk mengasingkan komponen yang rosak dengan lebih cepat, dan menghalang lonjakan pelaporan ralat daripada menggunakan sumber sistem. Dengan infrastruktur yang merangkumi 330 bandar dan menguasai kira-kira 20% daripada web, Cloudflare menekankan komitmennya untuk mencegah kegagalan serupa pada masa hadapan.
Membungkus Up
Insiden ini menyerlahkan betapa banyak internet hari ini bergantung pada sebilangan kecil penyedia perkhidmatan asas. Apabila salah satu rangkaian ini mengalami kerosakan, kesan riak boleh mencapai berjuta-juta pengguna dalam beberapa minit. Sebagai Cloudflare bekerja pada rancangan pemulihannya, HostScore.net kekal komited terhadap ketelusan, pemantauan berterusan dan penambahbaikan berterusan yang mengukuhkan daya tahan platform kami dan kebolehpercayaan perkhidmatan yang bergantung kepada pembaca kami.