# Google Cloud एक खाली फ़ील्ड पर क्रैश हो गया। तीन घंटे।

Published: 2026-09-19

कुछ खाली फ़ील्ड वाली एक नीति पंक्ति एक नल पॉइंटर से टकराती है, और Google Cloud एक साथ हर क्षेत्र में क्रैश हो जाता है - फिर Cloudflare भी इसके साथ गिर जाता है। 12 जून, 2025, 17:49 यूटीसी: सर्विस कंट्रोल, वह बाइनरी जो हर Google Cloud API अनुरोध को मंज़ूरी देता है, "अनपेक्षित खाली फ़ील्ड" के साथ एक कोटा-नीति परिवर्तन को पढ़ता है, दो सप्ताह पहले बिना किसी नल चेक और बिना किसी सुविधा फ़्लैग के भेजी गई एक कोड पथ से टकराता है, और हर क्षेत्र में एक क्रैश लूप में चला जाता है - पंक्ति कुछ ही सेकंड में विश्व स्तर पर प्रतिकृत हो गई थी। बाहरी API तीन घंटे के लिए 503 लौटाते हैं; us-central1 को 2 घंटे 40 मिनट लगते हैं क्योंकि पुनरारंभ होने वाले कार्य बिना किसी यादृच्छिक बैकऑफ़ के उसी स्पैनर तालिका पर टूट पड़ते हैं। Google के आउटेज के तीन मिनट के भीतर, Cloudflare के Workers KV - जिसका सत्य स्रोत "एक तृतीय-पक्ष क्लाउड प्रदाता" पर स्थित है - 90% अनुरोध खो देता है, और Access, WARP, Workers AI, Pages, Stream और Turnstile इसके साथ 2 घंटे 28 मिनट के लिए बंद हो जाते हैं। Google का स्टेटस पेज एक घंटे देर से अपना पहला अपडेट पोस्ट करता है, क्योंकि यह Google Cloud पर चलता है।

Canonical: https://thedailydiff.dev/hi/video/2026-09-19-google-cloud-null-pointer/

## इस वीडियो में क्या शामिल है

- एक खाली फ़ील्ड, एक नल पॉइंटर, हर क्षेत्र
- समय-सीमा: 29 मई → 17:45 → क्रैश लूप → लाल बटन → 17:52 Cloudflare
- us-central1: झुंड प्रभाव
- तंत्र: अनुरोध पथ में जाँच, वैश्विक प्रतिकृति, एक विक्रेता
- git blame — विभाजन

## अध्याय

- 0:00 एक खाली फ़ील्ड, एक नल पॉइंटर, हर क्षेत्र
- 0:32 समय-सीमा: 29 मई → 17:45 → क्रैश लूप → लाल बटन → 17:52 Cloudflare
- 1:32 us-central1: झुंड प्रभाव
- 1:43 तंत्र: अनुरोध पथ में जाँच, वैश्विक प्रतिकृति, एक विक्रेता
- 2:00 git blame — विभाजन
- 2:20 विस्फोट का दायरा
- 2:33 फैसला + सोमवार की पंक्ति

## अनुवादित प्रतिलेख

मूल अंग्रेजी कथन से अनुवादित। उपलब्ध ऑडियो और कैप्शन YouTube द्वारा नियंत्रित होते हैं।

### एक खाली फ़ील्ड, एक नल पॉइंटर, हर क्षेत्र

0:00 खाली फ़ील्ड वाली एक नीति पंक्ति एक नल पॉइंटर से टकराती है, और Google Cloud क्रैश हो जाता है एक साथ हर क्षेत्र में — और Cloudflare भी इसके साथ गिर जाता है, फिर Google को "एक तृतीय-पक्ष प्रदाता" कहता है। 12 जून, 2025, 17:49 यूटीसी। Google की रिपोर्ट: सर्विस कंट्रोल, वह बाइनरी जो हर API अनुरोध को मंज़ूरी देता है, तीन घंटे के लिए एक क्रैश लूप में। Cloudflare का, उसी शाम: Workers KV, नब्बे प्रतिशत विफल हो रहा है, दो घंटे अट्ठाईस मिनट।

0:23 यह कैसे हुआ, क्यों एक खाली फ़ील्ड कुछ ही सेकंड में वैश्विक हो गया, और किसे दोष दिया जाता है। यह The Daily Diff, पोस्टमॉर्टम है। 29 मई। सर्विस कंट्रोल को एक नई कोटा जाँच मिलती है, जो एक

### समय-सीमा: 29 मई → 17:45 → क्रैश लूप → लाल बटन → 17:52 Cloudflare

0:35 लाल बटन के साथ क्षेत्र-वार भेजी जाती है — लेकिन नया कोड पथ रोलआउट के दौरान कभी नहीं चलता; कुछ भी इसे अभी तक ट्रिगर नहीं करता है। कोई नल चेक नहीं। कोई फीचर फ़्लैग नहीं। 17:45। खाली फ़ील्ड के साथ एक नीति परिवर्तन स्पैनर तालिका में आता है। कोटा वैश्विक है, इसलिए पंक्ति कुछ ही सेकंड में हर जगह प्रतिकृत हो जाती है। हर सर्विस कंट्रोल बाइनरी इसे पढ़ता है, नल पॉइंटर से टकराता है, क्रैश होता है, पुनरारंभ होता है, इसे फिर से पढ़ता है। हर API कॉल: 503।

0:55 Google तेज़ है: दो मिनट में ट्राइएज, दस मिनट में मूल कारण। लाल बटन चालीस मिनट में बाहर हो जाता है, और छोटे क्षेत्र पहले ठीक हो जाते हैं। स्टेटस पेज एक घंटे बाद अपना पहला अपडेट पोस्ट करता है, क्योंकि यह Google Cloud पर चलता है। 17:52। Cloudflare की WARP टीम देखती है कि नए डिवाइस रजिस्टर करने में विफल हो रहे हैं। Workers KV, Cloudflare का आधा स्टोर जो कॉन्फ़िगरेशन और पहचान के लिए उपयोग करता है, एक तृतीय-पक्ष क्लाउड पर रहता है। Access हर लॉगिन में विफल रहता है — डिज़ाइन के अनुसार, यह बंद विफल हो जाता है।

1:20 Workers AI हर अनुमान में विफल रहता है। 19:11, गेर्गेली ओरोस: दो स्वतंत्र क्लाउड एक साथ बंद हो गए, पहले कभी नहीं देखा। 19:32, Google समर्थन एक उपयोगकर्ता को बताता है कि कोई ज्ञात व्यवधान नहीं हैं — कुकीज़ साफ़ करने का प्रयास करें, आपकी कुकीज़। हर जगह 19:48 तक ठीक हो जाता है।

### us-central1: झुंड प्रभाव

1:34 us-central1 नहीं: पुनरारंभ होने वाले कार्य उसी स्पैनर तालिका पर टूट पड़ते हैं, कोई यादृच्छिक बैकऑफ़ नहीं, इसलिए Google उन्हें हाथ से धीमा करता है। दो घंटे चालीस मिनट। एक: नीति जाँच अनुरोध पथ के अंदर बैठती है; जब जाँच मर जाती है,

### तंत्र: अनुरोध पथ में जाँच, वैश्विक प्रतिकृति, एक विक्रेता

1:46 API मर जाता है। दो: कोटा डेटा बिना स्टेजिंग के वैश्विक हो जाता है; एक खराब पंक्ति एक वैश्विक पंक्ति है। तीन: Cloudflare जानता था। Workers KV अपने स्वयं के R2 में मध्य-माइग्रेशन था, एक प्रदाता तक — पोस्ट-मॉर्टम इसे कवरेज में एक अंतर कहता है।

### git blame — विभाजन

2:00 git blame। Google, पचपन प्रतिशत: कोई नल चेक नहीं, कोई फीचर फ़्लैग नहीं, कोई बैकऑफ़ नहीं — उनकी रिपोर्ट कहती है कि एक फ़्लैग इसे स्टेजिंग में पकड़ लेता। वैश्विक प्रतिकृति, बीस: एक पंक्ति, हर क्षेत्र, सेकंड। Cloudflare, बीस: एक विक्रेता के स्टोर पर एक उत्पाद लाइन का आधा हिस्सा, और एक पोस्ट-मॉर्टम जो कभी Google नहीं कहता। स्टेटस पेज, पाँच, जिस पर वह रिपोर्ट करता है, उस पर रहने के लिए। विस्फोट का दायरा: सत्तर Google Cloud उत्पाद, दस Workspace ऐप,

### विस्फोट का दायरा

2:23 हर क्षेत्र। तीन घंटे। Cloudflare में: Access, WARP, Workers AI, Pages, Stream — ढाई घंटे। Hacker News, चौदह सौ अंक; शीर्ष टिप्पणी: स्टेटस पेज हरा है।

### फैसला + सोमवार की पंक्ति

2:33 फैसला, पोस्ट-मॉर्टम: SHIP IT। दोनों पोस्ट-मॉर्टम तीस घंटे के भीतर आते हैं, दोनों खुद को दोषी ठहराते हैं, और Google के समाधान ठोस हैं: खुले में विफल, डिफ़ॉल्ट रूप से फ़्लैग बंद, घातांक बैकऑफ़। सोमवार की पंक्ति: एक फ़्लैग के पीछे नया कोड जो बंद होता है, और एक नल चेक जहाँ डेटा आता है। मुझे वह घटना भेजें जिसके बारे में आपको अभी भी बात करने की अनुमति नहीं है, टिप्पणियों में, या daily diff dot dev पर। और आज के लिए यही अंतर है।

2:53 मैं Axrisi से Niko हूँ। जिम्मेदारी से विलय करें।

## स्रोत

- [Google Cloud Service Health, Incident Report (Jun 13, 2025) + Mini Incident Report (Jun 12)](https://status.cloud.google.com/incidents/ow5i3PPK96RduMcb1SsW) — status.cloud.google.com
- [Cloudflare, "Cloudflare service outage June 12, 2025" (Jun 12, 2025, 22:00 UTC)](https://blog.cloudflare.com/cloudflare-service-outage-june-12-2025/) — blog.cloudflare.com
- [Cloudflare Status, "Broad Cloudflare service outages" (18:19–21:31 UTC)](https://www.cloudflarestatus.com/incidents/25r9t0vz99rp) — www.cloudflarestatus.com
- [Gergely Orosz, 19:11 UTC, "Their infra is fully independent AFAIK"](https://x.com/GergelyOrosz/status/1933240698716729511) — x.com
- [@Google support, 19:32 UTC, "there aren't any known service disruptions"](https://x.com/Google/status/1933246051512644069) — x.com
- [Thomas Kurian (Google Cloud CEO), Jun 13 01:35 UTC](https://x.com/ThomasOrTK/status/1933337436970709493) — x.com
- [Hacker News, "GCP Outage" (1,468 points)](https://news.ycombinator.com/item?id=44260810) — news.ycombinator.com
- [Hacker News, "Cloudflare was down" (341 points)](https://news.ycombinator.com/item?id=44261064) — news.ycombinator.com
- [Hacker News, "Google Cloud Incident Report – 2025-06-13" (209 points)](https://news.ycombinator.com/item?id=44274563) — news.ycombinator.com
