# Google Cloud หยุดทำงานเนื่องจากช่องว่างเปล่า สามชั่วโมง

Published: 2026-09-19

แถวนโยบายที่มีช่องว่างเปล่าบางส่วนทำให้เกิดข้อผิดพลาด null pointer และ Google Cloud หยุดทำงานพร้อมกันในทุกภูมิภาค จากนั้น Cloudflare ก็ล่มตามไปด้วย วันที่ 12 มิถุนายน 2025, 17:49 UTC: Service Control ซึ่งเป็นไบนารีที่อนุมัติคำขอ Google Cloud API ทุกรายการ ได้อ่านการเปลี่ยนแปลงนโยบายโควต้าที่มี "ช่องว่างเปล่าที่ไม่ได้ตั้งใจ" พบเส้นทางโค้ดที่จัดส่งสองสัปดาห์ก่อนหน้านี้โดยไม่มีการตรวจสอบ null และไม่มี feature flag และเข้าสู่ crash loop ในทุกภูมิภาค – แถวนี้ได้จำลองแบบทั่วโลกภายในไม่กี่วินาที API ภายนอกคืนค่า 503 เป็นเวลาสามชั่วโมง; us-central1 ใช้เวลา 2 ชั่วโมง 40 นาที เนื่องจากงานที่รีสตาร์ทบุกโจมตีตาราง Spanner เดียวกันโดยไม่มี randomized backoff สามนาทีหลังจาก Google หยุดทำงาน Workers KV ของ Cloudflare – ซึ่งมีแหล่งข้อมูลที่เชื่อถือได้อยู่บน "ผู้ให้บริการคลาวด์บุคคลที่สาม" – สูญเสีย 90% ของคำขอ และ Access, WARP, Workers AI, Pages, Stream และ Turnstile ก็ล่มตามไปด้วยเป็นเวลา 2 ชั่วโมง 28 นาที หน้าสถานะของ Google โพสต์การอัปเดตครั้งแรกช้าไปหนึ่งชั่วโมง เนื่องจากทำงานบน Google Cloud

Canonical: https://thedailydiff.dev/th/video/2026-09-19-google-cloud-null-pointer/

## วิดีโอนี้ครอบคลุมอะไรบ้าง

- ช่องว่างเปล่า, null pointer, ทุกภูมิภาค
- ไทม์ไลน์: 29 พฤษภาคม → 17:45 → crash loop → ปุ่มแดง → 17:52 Cloudflare
- us-central1: ผลกระทบจากฝูงชน
- กลไก: ตรวจสอบในเส้นทางคำขอ, การจำลองแบบทั่วโลก, ผู้ให้บริการรายเดียว
- git blame — การแบ่งแยก

## บท

- 0:00 ช่องว่างเปล่า, null pointer, ทุกภูมิภาค
- 0:32 ไทม์ไลน์: 29 พฤษภาคม → 17:45 → crash loop → ปุ่มแดง → 17:52 Cloudflare
- 1:32 us-central1: ผลกระทบจากฝูงชน
- 1:43 กลไก: ตรวจสอบในเส้นทางคำขอ, การจำลองแบบทั่วโลก, ผู้ให้บริการรายเดียว
- 2:00 git blame — การแบ่งแยก
- 2:20 รัศมีผลกระทบ
- 2:33 คำตัดสิน + The Monday line

## บทถอดเสียงที่แปลแล้ว

แปลจากการบรรยายภาษาอังกฤษต้นฉบับ เสียงและคำบรรยายที่มีให้จะควบคุมโดย YouTube

### ช่องว่างเปล่า, null pointer, ทุกภูมิภาค

0:00 แถวนโยบายที่มีช่องว่างเปล่าทำให้เกิด null pointer และ Google Cloud หยุดทำงานใน ทุกภูมิภาคพร้อมกัน — และ Cloudflare ก็ล่มตามไปด้วย จากนั้นเรียกว่า Google เป็น "ผู้ให้บริการบุคคลที่สาม" วันที่ 12 มิถุนายน 2025, 17:49 UTC รายงานของ Google: Service Control ซึ่งเป็นไบนารีที่อนุมัติคำขอ API ทุกรายการ อยู่ใน crash loop เป็นเวลาสามชั่วโมง ของ Cloudflare, ในเย็นวันเดียวกัน: Workers KV, ล้มเหลวเก้าสิบเปอร์เซ็นต์ สองชั่วโมงยี่สิบแปดนาที

0:23 เกิดได้อย่างไร, ทำไมช่องว่างเปล่าหนึ่งช่องจึงแพร่ไปทั่วโลกในไม่กี่วินาที และใครต้องรับผิดชอบ นี่คือ The Daily Diff, postmortem 29 พฤษภาคม Service Control ได้รับการตรวจสอบโควต้าใหม่, จัดส่งทีละภูมิภาคพร้อม

### ไทม์ไลน์: 29 พฤษภาคม → 17:45 → crash loop → ปุ่มแดง → 17:52 Cloudflare

0:35 ปุ่มแดง — แต่เส้นทางโค้ดใหม่ไม่เคยทำงานระหว่างการเปิดตัว; ไม่มีอะไรกระตุ้น มันเลย ยังไม่มีการตรวจสอบ null ไม่มี feature flag 17:45 การเปลี่ยนแปลงนโยบายที่มีช่องว่างเปล่าไปอยู่ในตาราง Spanner โควต้าเป็นแบบทั่วโลก ดังนั้นแถวจะจำลองแบบทุกที่ภายในไม่กี่วินาที ไบนารี Service Control ทุกตัวจะอ่านมัน, พบ null pointer, หยุดทำงาน, รีสตาร์ท, อ่านซ้ำอีกครั้ง การเรียก API ทุกครั้ง: 503

0:55 Google รวดเร็ว: คัดแยกในสองนาที, พบสาเหตุในสิบนาที ปุ่มแดงถูกกดภายในสี่สิบนาที, และภูมิภาคเล็ก ๆ ฟื้นตัวก่อน หน้าสถานะโพสต์การอัปเดตครั้งแรกในหนึ่งชั่วโมง เพราะมันทำงานบน Google Cloud 17:52 ทีม WARP ของ Cloudflare พบว่าอุปกรณ์ใหม่ไม่สามารถลงทะเบียนได้ Workers KV ซึ่งเป็นส่วนที่ Cloudflare ใช้สำหรับ config และ identity อยู่บนคลาวด์ของบุคคลที่สาม Access ล้มเหลวทุกการเข้าสู่ระบบ — โดยการออกแบบ มันจะล้มเหลวแบบปิด

1:20 Workers AI ล้มเหลวทุกการอนุมาน 19:11, Gergely Orosz: คลาวด์อิสระสองแห่งล่มพร้อมกัน ไม่เคยเห็นมาก่อน 19:32, ฝ่ายสนับสนุนของ Google บอกผู้ใช้ว่าไม่มีการหยุดชะงักที่ทราบ — ให้ลองล้าง คุกกี้ของคุณ ทุกที่อื่นฟื้นตัวภายใน 19:48

### us-central1: ผลกระทบจากฝูงชน

1:34 us-central1 ไม่เป็นเช่นนั้น: งานที่รีสตาร์ทบุกโจมตีตาราง Spanner เดียวกัน ไม่มี randomized backoff ดังนั้น Google จึงควบคุมด้วยตนเอง สองชั่วโมงสี่สิบนาที ข้อแรก: การตรวจสอบนโยบายอยู่ในเส้นทางคำขอ; เมื่อการตรวจสอบล้มเหลว

### กลไก: ตรวจสอบในเส้นทางคำขอ, การจำลองแบบทั่วโลก, ผู้ให้บริการรายเดียว

1:46 API ก็ล้มเหลว ข้อสอง: ข้อมูลโควต้าไปทั่วโลกโดยไม่มีการจัดเตรียม; แถวที่ไม่ดีคือแถวทั่วโลก ข้อสาม: Cloudflare รู้ Workers KV อยู่ระหว่างการย้ายข้อมูลไปยัง R2 ของตนเอง, เหลือผู้ให้บริการรายเดียว — postmortem เรียกมันว่าช่องว่างในการครอบคลุม

### git blame — การแบ่งแยก

2:00 git blame. Google, ห้าสิบห้าเปอร์เซ็นต์: ไม่มีการตรวจสอบ null, ไม่มี feature flag, ไม่มี backoff — รายงานของพวกเขากล่าวว่าธงจะตรวจพบในขั้นตอนการจัดเตรียม การจำลองแบบทั่วโลก, ยี่สิบเปอร์เซ็นต์: หนึ่งแถว, ทุกภูมิภาค วินาที Cloudflare, ยี่สิบเปอร์เซ็นต์: ผลิตภัณฑ์ครึ่งหนึ่งอยู่บนร้านค้าของผู้จำหน่ายรายเดียว และ postmortem ที่ไม่เคยกล่าวถึง Google หน้าสถานะ, ห้าเปอร์เซ็นต์, สำหรับการทำงานบนสิ่งที่รายงาน รัศมีผลกระทบ: ผลิตภัณฑ์ Google Cloud เจ็ดสิบรายการ, แอป Workspace สิบรายการ

### รัศมีผลกระทบ

2:23 ทุกภูมิภาค สามชั่วโมง ที่ Cloudflare: Access, WARP, Workers AI, Pages, Stream — สองชั่วโมงครึ่ง Hacker News, หนึ่งพันสี่ร้อยคะแนน; ความคิดเห็นยอดนิยม: หน้าสถานะเป็นสีเขียว

### คำตัดสิน + The Monday line

2:33 คำตัดสิน, postmortem: SHIP IT ทั้งสอง postmortem เผยแพร่ภายในสามสิบชั่วโมง, ทั้งสองโทษตัวเอง และการแก้ไขของ Google นั้นชัดเจน: fail open, flag ปิดโดยค่าเริ่มต้น exponential backoff. The Monday line: โค้ดใหม่ภายใต้ flag ที่ปิดอยู่ และการตรวจสอบ null ที่ข้อมูลเข้ามา ส่งเหตุการณ์ที่คุณยังไม่ได้รับอนุญาตให้พูดถึงมาให้ฉัน ในความคิดเห็น, หรือที่ the daily diff dot dev และนั่นคือ diff สำหรับวันนี้

2:53 ฉัน Niko จาก Axrisi Merge responsibly

## แหล่งที่มา

- [Google Cloud Service Health, Incident Report (Jun 13, 2025) + Mini Incident Report (Jun 12)](https://status.cloud.google.com/incidents/ow5i3PPK96RduMcb1SsW) — status.cloud.google.com
- [Cloudflare, "Cloudflare service outage June 12, 2025" (Jun 12, 2025, 22:00 UTC)](https://blog.cloudflare.com/cloudflare-service-outage-june-12-2025/) — blog.cloudflare.com
- [Cloudflare Status, "Broad Cloudflare service outages" (18:19–21:31 UTC)](https://www.cloudflarestatus.com/incidents/25r9t0vz99rp) — www.cloudflarestatus.com
- [Gergely Orosz, 19:11 UTC, "Their infra is fully independent AFAIK"](https://x.com/GergelyOrosz/status/1933240698716729511) — x.com
- [@Google support, 19:32 UTC, "there aren't any known service disruptions"](https://x.com/Google/status/1933246051512644069) — x.com
- [Thomas Kurian (Google Cloud CEO), Jun 13 01:35 UTC](https://x.com/ThomasOrTK/status/1933337436970709493) — x.com
- [Hacker News, "GCP Outage" (1,468 points)](https://news.ycombinator.com/item?id=44260810) — news.ycombinator.com
- [Hacker News, "Cloudflare was down" (341 points)](https://news.ycombinator.com/item?id=44261064) — news.ycombinator.com
- [Hacker News, "Google Cloud Incident Report – 2025-06-13" (209 points)](https://news.ycombinator.com/item?id=44274563) — news.ycombinator.com
