# گوگل کلاؤڈ ایک خالی فیلڈ پر کریش ہو گیا۔ تین گھنٹے۔

Published: 2026-09-19

کچھ خالی فیلڈز کے ساتھ ایک پالیسی رو ایک نل پوائنٹر کو ہٹ کرتی ہے، اور گوگل کلاؤڈ ہر خطے میں ایک ساتھ کریش ہو جاتا ہے — پھر کلاؤڈ فلیر اس کے ساتھ گر جاتا ہے۔ 12 جون 2025، 17:49 UTC: سروس کنٹرول، وہ بائنری جو ہر گوگل کلاؤڈ API کی درخواست کو منظور کرتی ہے، "غیر ارادی خالی فیلڈز" کے ساتھ ایک کوٹہ پالیسی میں تبدیلی پڑھتی ہے، ایک کوڈ پاتھ کو ہٹ کرتی ہے جو دو ہفتے پہلے بغیر نل چیک اور بغیر فیچر فلیگ کے بھیجا گیا تھا، اور ہر خطے میں ایک کریش لوپ میں چلا جاتا ہے — رو نے سیکنڈوں میں عالمی سطح پر نقل کر لی تھی۔ بیرونی APIs تین گھنٹے کے لیے 503 واپس کرتے ہیں؛ us-central1 کو 2 گھنٹے 40 منٹ لگتے ہیں کیونکہ دوبارہ شروع ہونے والے ٹاسک ایک ہی سپینر ٹیبل پر بغیر رینڈمائزڈ بیک آف کے ہجوم کر دیتے ہیں۔ گوگل کی بندش کے تین منٹ بعد، کلاؤڈ فلیر کے ورکرز KV — جس کی سچائی کا ذریعہ "ایک تیسرے فریق کلاؤڈ فراہم کنندہ" پر ہے — 90% درخواستیں کھو دیتا ہے، اور ایکسیس، وارپ، ورکرز AI، پیجز، سٹریم اور ٹرن اسٹائل اس کے ساتھ 2 گھنٹے 28 منٹ کے لیے نیچے چلے جاتے ہیں۔ گوگل کا اسٹیٹس پیج ایک گھنٹہ دیر سے اپنی پہلی اپ ڈیٹ پوسٹ کرتا ہے، کیونکہ یہ گوگل کلاؤڈ پر چلتا ہے۔

Canonical: https://thedailydiff.dev/ur/video/2026-09-19-google-cloud-null-pointer/

## اس ویڈیو میں کیا شامل ہے

- ایک خالی فیلڈ، ایک نل پوائنٹر، ہر علاقہ
- ٹائم لائن: 29 مئی → 17:45 → کریش لوپ → ریڈ بٹن → 17:52 کلاؤڈ فلیر
- us-central1: ہارڈ ایفیکٹ
- میکانزم: ریکویسٹ پاتھ میں چیک، گلوبل ریپلیکیشن، ایک وینڈر
- git blame — سپلٹ

## ابواب

- 0:00 ایک خالی فیلڈ، ایک نل پوائنٹر، ہر علاقہ
- 0:32 ٹائم لائن: 29 مئی → 17:45 → کریش لوپ → ریڈ بٹن → 17:52 کلاؤڈ فلیر
- 1:32 us-central1: ہارڈ ایفیکٹ
- 1:43 میکانزم: ریکویسٹ پاتھ میں چیک، گلوبل ریپلیکیشن، ایک وینڈر
- 2:00 git blame — سپلٹ
- 2:20 دھماکے کا رداس
- 2:33 فیصلہ + پیر کی لائن

## ترجمہ شدہ ٹرانسکرپٹ

اصل انگریزی بیان سے ترجمہ کیا گیا۔ دستیاب آڈیو اور کیپشنز یوٹیوب کے زیر انتظام ہیں۔

### ایک خالی فیلڈ، ایک نل پوائنٹر، ہر علاقہ

0:00 خالی فیلڈز کے ساتھ ایک پالیسی رو ایک نل پوائنٹر کو ہٹ کرتی ہے، اور گوگل کلاؤڈ میں کریش ہو جاتا ہے ہر خطے میں ایک ساتھ — اور کلاؤڈ فلیر اس کے ساتھ گر جاتا ہے، پھر گوگل کو "ایک تیسرے فریق فراہم کنندہ" کہتا ہے۔ 12 جون 2025، 17:49 UTC۔ گوگل کی رپورٹ: سروس کنٹرول، وہ بائنری جو ہر API درخواست کو منظور کرتی ہے، تین گھنٹے کے لیے ایک کریش لوپ میں۔ کلاؤڈ فلیر کا، اسی شام: ورکرز KV، نوے فیصد ناکام، دو گھنٹے اٹھائیس۔

0:23 یہ کیسے ہوا، کیوں ایک خالی فیلڈ سیکنڈوں میں عالمی ہو گیا، اور کون قصوروار ہے۔ یہ The Daily Diff، پوسٹ مارٹم ہے۔ 29 مئی۔ سروس کنٹرول کو ایک نیا کوٹہ چیک ملتا ہے، جو ایک

### ٹائم لائن: 29 مئی → 17:45 → کریش لوپ → ریڈ بٹن → 17:52 کلاؤڈ فلیر

0:35 ریڈ بٹن کے ساتھ خطے بہ خطے بھیجا جاتا ہے — لیکن نیا کوڈ پاتھ رول آؤٹ کے دوران کبھی نہیں چلتا؛ کوئی چیز اسے ابھی تک متحرک نہیں کرتی۔ کوئی نل چیک نہیں۔ کوئی فیچر فلیگ نہیں۔ 17:45۔ خالی فیلڈز کے ساتھ ایک پالیسی کی تبدیلی سپینر ٹیبل میں اترتی ہے۔ کوٹہ عالمی ہے، لہذا رو سیکنڈوں میں ہر جگہ نقل ہو جاتا ہے۔ ہر سروس کنٹرول بائنری اسے پڑھتا ہے، نل پوائنٹر کو ہٹ کرتا ہے، کریش ہو جاتا ہے، دوبارہ شروع ہوتا ہے، اسے دوبارہ پڑھتا ہے۔ ہر API کال: 503۔

0:55 گوگل تیز ہے: دو منٹ میں ٹریج، دس منٹ میں اصل وجہ۔ ریڈ بٹن چالیس میں باہر ہے، اور چھوٹے علاقے پہلے بحال ہوتے ہیں۔ اسٹیٹس پیج ایک گھنٹہ میں اپنی پہلی اپ ڈیٹ پوسٹ کرتا ہے، کیونکہ یہ گوگل کلاؤڈ پر چلتا ہے۔ 17:52۔ کلاؤڈ فلیر کی WARP ٹیم نئے آلات کو رجسٹر ہونے میں ناکام دیکھتی ہے۔ ورکرز KV، سٹور کا نصف حصہ جو کلاؤڈ فلیر کنفگ اور شناخت کے لیے استعمال کرتا ہے، ایک تیسرے فریق کلاؤڈ پر رہتا ہے۔ ایکسیس ہر لاگ ان میں ناکام رہتا ہے — ڈیزائن کے مطابق، یہ بند ہو جاتا ہے۔

1:20 ورکرز AI ہر انفرنس میں ناکام رہتا ہے۔ 19:11، گرگیلی اوروز: دو آزاد کلاؤڈز ایک ساتھ ڈاؤن، پہلے کبھی نہیں دیکھا۔ 19:32، گوگل سپورٹ ایک صارف کو بتاتا ہے کہ کوئی معلوم رکاوٹیں نہیں ہیں — کوشش کریں کہ اپنی کوکیز صاف کریں۔ باقی سب 19:48 تک بحال ہو جاتا ہے۔

### us-central1: ہارڈ ایفیکٹ

1:34 us-central1 نہیں ہوتا: دوبارہ شروع ہونے والے ٹاسک ایک ہی سپینر ٹیبل پر ہجوم کر دیتے ہیں، کوئی رینڈمائزڈ بیک آف نہیں، لہذا گوگل انہیں ہاتھ سے تھروٹل کرتا ہے۔ دو گھنٹے چالیس۔ ایک: پالیسی چیک ریکویسٹ پاتھ کے اندر ہے؛ جب چیک مر جاتا ہے،

### میکانزم: ریکویسٹ پاتھ میں چیک، گلوبل ریپلیکیشن، ایک وینڈر

1:46 API مر جاتا ہے۔ دو: کوٹہ ڈیٹا بغیر اسٹیجنگ کے عالمی ہو جاتا ہے؛ ایک خراب رو ایک عالمی رو ہے۔ تین: کلاؤڈ فلیر جانتا تھا۔ ورکرز KV اپنے R2 میں منتقلی کے وسط میں تھا، ایک فراہم کنندہ تک — پوسٹ مارٹم اسے کوریج میں ایک خلا کہتا ہے۔

### git blame — سپلٹ

2:00 git blame۔ گوگل، پچپن فیصد: کوئی نل چیک نہیں، کوئی فیچر فلیگ نہیں، کوئی بیک آف نہیں — ان کی رپورٹ کہتی ہے کہ ایک فلیگ اسے اسٹیجنگ میں پکڑ لیتا۔ گلوبل ریپلیکیشن، بیس: ایک رو، ہر علاقہ، سیکنڈ۔ کلاؤڈ فلیر، بیس: ایک وینڈر کے سٹور پر آدھی پروڈکٹ لائن، اور ایک پوسٹ مارٹم جو کبھی گوگل نہیں کہتا۔ اسٹیٹس پیج، پانچ، جس پر رپورٹ کرتا ہے اس پر رہنے کے لیے۔ دھماکے کا رداس: ستر گوگل کلاؤڈ پروڈکٹس، دس ورک اسپیس ایپس،

### دھماکے کا رداس

2:23 ہر علاقہ۔ تین گھنٹے۔ کلاؤڈ فلیر پر: ایکسیس، WARP، ورکرز AI، پیجز، سٹریم — ڈھائی۔ ہیکر نیوز، چودہ سو پوائنٹس؛ سب سے اوپر کا تبصرہ: اسٹیٹس پیج سبز ہے۔

### فیصلہ + پیر کی لائن

2:33 فیصلہ، پوسٹ مارٹم: SHIP IT۔ دونوں پوسٹ مارٹم تیس گھنٹے کے اندر اندر آتے ہیں، دونوں خود کو قصوروار ٹھہراتے ہیں، اور گوگل کے اصلاحات ٹھوس ہیں: fail open، flags off by default، exponential backoff۔ پیر کی لائن: ایک فلیگ کے پیچھے نیا کوڈ جو آف بھیجتا ہے، اور ایک نل چیک جہاں ڈیٹا آتا ہے۔ مجھے وہ واقعہ بھیجیں جس کے بارے میں آپ کو اب بھی بات کرنے کی اجازت نہیں ہے، تبصروں میں، یا the daily diff dot dev پر۔ اور یہ آج کا diff ہے۔

2:53 میں Axrisi سے نیکو ہوں۔ Merge responsibly۔

## ذرائع

- [Google Cloud Service Health, Incident Report (Jun 13, 2025) + Mini Incident Report (Jun 12)](https://status.cloud.google.com/incidents/ow5i3PPK96RduMcb1SsW) — status.cloud.google.com
- [Cloudflare, "Cloudflare service outage June 12, 2025" (Jun 12, 2025, 22:00 UTC)](https://blog.cloudflare.com/cloudflare-service-outage-june-12-2025/) — blog.cloudflare.com
- [Cloudflare Status, "Broad Cloudflare service outages" (18:19–21:31 UTC)](https://www.cloudflarestatus.com/incidents/25r9t0vz99rp) — www.cloudflarestatus.com
- [Gergely Orosz, 19:11 UTC, "Their infra is fully independent AFAIK"](https://x.com/GergelyOrosz/status/1933240698716729511) — x.com
- [@Google support, 19:32 UTC, "there aren't any known service disruptions"](https://x.com/Google/status/1933246051512644069) — x.com
- [Thomas Kurian (Google Cloud CEO), Jun 13 01:35 UTC](https://x.com/ThomasOrTK/status/1933337436970709493) — x.com
- [Hacker News, "GCP Outage" (1,468 points)](https://news.ycombinator.com/item?id=44260810) — news.ycombinator.com
- [Hacker News, "Cloudflare was down" (341 points)](https://news.ycombinator.com/item?id=44261064) — news.ycombinator.com
- [Hacker News, "Google Cloud Incident Report – 2025-06-13" (209 points)](https://news.ycombinator.com/item?id=44274563) — news.ycombinator.com
