Amazon Web Services หยุดให้บริการทั่วโลก: เกิดอะไรขึ้น และใครได้รับผลกระทบ?

  • เหตุการณ์ AWS ทั่วโลกที่มีต้นตอมาจาก US-EAST-1 (เวอร์จิเนีย) ระบุว่าเป็นปัญหา DNS
  • ผลกระทบแบบตัดขวาง: Amazon, Alexa, Prime Video, ธนาคาร (BBVA, Santander, CaixaBank), โทรศัพท์ข้อมูล, Ticketmaster และวิดีโอเกม เช่น Fortnite หรือ Roblox
  • เริ่มมีการเตือนภัยประมาณ 08:40 น. (CST) คาดว่าจะเริ่มมีสัญญาณการฟื้นตัวในช่วงกลางเช้า และปัญหาพื้นฐานจะบรรเทาลงในช่วงบ่าย
  • AWS แนะนำให้ล้างแคช DNS และเตือนถึงข้อจำกัดที่อาจเกิดขึ้นเป็นครั้งคราวในขณะที่ระบบกำลังอยู่ในสภาวะปกติ

ผลกระทบระดับโลกต่อ AWS

เหตุขัดข้องของระบบคลาวด์Amazon Web Services (AWS)เมื่อวันจันทร์ ทำให้เกิดการหยุดชะงักทั่วโลก ส่งผลกระทบต่อเว็บไซต์ แอปพลิเคชัน และวิดีโอเกม ในช่วงเช้าตรู่ ผู้ใช้จำนวนมากในสเปนรายงานปัญหาการเข้าถึงและประสิทธิภาพการทำงานที่ช้าลงบนบริการยอดนิยม ซึ่งบ่งชี้ว่าเป็นการหยุดชะงักทั่วโลกในวงกว้างผิดปกติ

การแจ้งเตือนครั้งแรกบนเว็บไซต์ตรวจสอบ DownDetector เริ่มขึ้นประมาณ08:40 น . (ตามเวลาภาคตะวันออกของสเปน) ตั้งแต่นั้นมา สื่อสังคมออนไลน์ก็เต็มไปด้วยข้อความที่อธิบายถึงข้อผิดพลาดในการเชื่อมต่อ เวลาในการโหลดที่ไม่มีที่สิ้นสุด และการหยุดชะงักเป็นระยะ ๆ บนแพลตฟอร์มสำคัญที่ต้องพึ่งพาโครงสร้างพื้นฐานของ AWS

บริการใดบ้างที่ได้รับผลกระทบ

แพลตฟอร์มที่ได้รับผลกระทบ ได้แก่ ผลิตภัณฑ์ของ Amazon เอง เช่น ร้านค้าออนไลน์ ผู้ช่วยอัจฉริยะ AlexaและPrime Videoรวมถึงบริการจากผู้ให้บริการภายนอก มีการรายงานปัญหาเกิดขึ้นกับCanva , Duolingo , เครื่องมือค้นหา AI Perplexityและเครือข่ายสังคมออนไลน์อย่างSnapchatโดยเฉพาะอย่างยิ่งในกลุ่มผู้เล่นเกม เนื่องจากมีปัญหาเกี่ยวกับFortnite , RobloxและClash Royale

ภาคการเงินได้รับผลกระทบ: แพลตฟอร์มจากBBVA , CaixaBank , Banco Santanderและบริการชำระเงินเช่นBizumประสบปัญหา เช่นเดียวกับเครื่องรับชำระเงิน ณ จุดขายในร้านค้าจริง ในสหรัฐอเมริกาVenmo (คล้ายกับ Bizum) ก็ประสบปัญหาเช่นกัน ซึ่งสะท้อนให้เห็นถึงผลกระทบต่อเนื่องจากการหยุดชะงัก ของระบบ

ความขัดข้องนี้ยังส่งผลกระทบต่อการออกและการขายตั๋วด้วยLive Nation รายงานว่า ระบบของTicketmaster ขัดข้อง จนถึงขั้นต้องเลื่อนการวางจำหน่ายตั๋วบางรายการ เช่น ทัวร์ของ La Oreja de Van Goghในขณะที่การขายตั๋วรายการอื่นๆ เช่น ของ Eric Claptonสามารถดำเนินต่อไปได้ตามปกติ

ในด้านการเชื่อมต่อและบริการสาธารณะ ผู้ให้บริการอย่างMovistar , OrangeและVodafone รายงานปัญหา ขณะที่ Aena รายงานปัญหาการชำระเงินด้วยบัตรในลานจอดรถของสนามบินในขณะเดียวกัน เครื่องมือสำหรับการทำงานร่วมกันและการสตรีมมิ่ง รวมถึงสื่อต่างๆ และแพลตฟอร์มอีคอมเมิร์ซ ประสบปัญหาการหยุดชะงักเป็นระยะ

แหล่งกำเนิดทางเทคนิคอยู่ที่ไหน

จากข้อมูลสถานะอย่างเป็นทางการ เหตุการณ์ดังกล่าวเกิดขึ้นใน ภูมิภาค US-EAST-1 (เวอร์จิเนียตอนเหนือ สหรัฐอเมริกา) ซึ่งเป็นหนึ่งในภูมิภาคที่ใหญ่ที่สุดและเก่าแก่ที่สุดของ AWS บริษัทระบุว่าปัญหา DNSเป็นสาเหตุหลัก ซึ่งเป็นส่วนประกอบสำคัญที่แปลงชื่อบริการเป็นที่อยู่ IP เพื่อให้เครื่องต่างๆ สามารถสื่อสารกันได้

ปัญหาการหยุดชะงักของ DNS ส่งผลกระทบต่อการแก้ไขชื่อโดเมนภายในภูมิภาค ทำให้บริการหลายอย่างไม่สามารถค้นหาปลายทาง ของตนได้ หนึ่งในบริการที่ได้รับผลกระทบหนักที่สุดคือAmazon DynamoDBซึ่งจุดเข้าถึงเกิดข้อผิดพลาดและลุกลามไปยังแอปพลิเคชันจำนวนมากที่พึ่งพาฐานข้อมูลนั้น

AWS ระบุว่า หากปัญหาการเชื่อมต่อกับ เอนด์พอยต์ DynamoDB ใน US-EAST-1 ยังคงอยู่หลังจากแก้ไขปัญหาแล้ว แนะนำให้ล้างแคช DNS ในขณะเดียวกันก็เตือนถึงข้อจำกัดบางประการเกี่ยวกับคำขอต่างๆ ในระหว่างที่ กำลัง ปรับปรุงเสถียรภาพของ แพลตฟอร์มทุกชั้น

ผลกระทบในสเปนและประเทศอื่นๆ

ในสเปน ผลกระทบเกิดขึ้นในด้านการทำธุรกรรมทางการเงินออนไลน์และการชำระเงินในร้านค้า แอปพลิเคชันที่ใช้กันอย่างแพร่หลาย และการซื้อตั๋ว บริษัทบางแห่งรายงานว่าเครื่องรับชำระเงิน ณ จุดขายหยุดทำงานในช่วงเช้าบางช่วง และผู้ใช้ประสบปัญหาในการเข้าสู่ระบบหรือทำธุรกรรมให้เสร็จสิ้นในแอปพลิ เคชัน ที่ ใช้กันทั่วไป

ปัญหาดังกล่าวเกิดขึ้นทั่วโลก โดยเฉพาะอย่างยิ่งในทวีปอเมริกาเหนือเนื่องจากตำแหน่งที่ตั้งของปัญหา แต่ก็ส่งผลกระทบต่อยุโรปและตลาดอื่นๆ ด้วยเช่นกัน บนแพลตฟอร์มโซเชียลมีเดียอย่าง X และ Reddit มีข้อความจำนวนมากเกี่ยวกับการที่Alexa ไม่ตอบ การทำงานของรูทีนที่ไม่ทำงาน และแอปที่ค้างอยู่ที่หน้าจอโหลด ซึ่งเป็นรูปแบบทั่วไปเมื่อการแก้ไข DNS ล้ม เหลว

นอกจากนี้ ยังมีเหตุการณ์ที่เกิดขึ้นพร้อมกันกับเหตุการณ์ที่ไม่เกี่ยวข้องกับ AWS เช่น การหยุดชะงักชั่วคราวของRedsysที่ส่งผลกระทบต่อการชำระเงินในสเปน แม้ว่า AWS จะออกมาปฏิเสธความเกี่ยวข้องกับปัญหาของ Amazon อย่างเป็นทางการ แต่เหตุการณ์ที่เกิดขึ้นพร้อมกันนี้ยิ่งทำให้เกิดความรู้สึกว่าบางภาคส่วน กำลังเผชิญกับ วิกฤตการณ์อย่างหนัก

ไทม์ไลน์และสถานะการกู้คืน

เหตุการณ์ระบบล่มเริ่มขึ้นประมาณ08:40 น . ตามเวลาในสเปน ในช่วงกลางเช้า AWS รายงานว่าเริ่มเห็นสัญญาณการฟื้นตัว แล้ว หลังจากดำเนินการแก้ไขปัญหา ประมาณเที่ยงวัน ปริมาณการใช้งานเริ่มกลับสู่ภาวะปกติในบริการ ต่างๆ มากขึ้นเรื่อยๆ โดยมีรายงานจาก DownDetector ลดลงอย่างเห็นได้ชัด

หลังจากผ่านไปไม่กี่ชั่วโมง บริษัทรายงานว่าปัญหา DNS ที่เป็นต้นเหตุได้รับการแก้ไขแล้ว และการดำเนินงานส่วนใหญ่กลับมาเป็นปกติ อย่างไรก็ตาม บริษัทเตือนว่าอาจมีข้อจำกัดบางประการในการร้องขอเฉพาะบางอย่างในระหว่างที่การกู้คืนระบบในภูมิภาคที่ได้รับผลกระทบเสร็จสมบูรณ์

เหตุใดการหยุดทำงานของ AWS จึงทำให้ครึ่งหนึ่งของอินเทอร์เน็ตหยุดทำงาน

AWS ช่วยให้ธุรกิจและนักพัฒนาสามารถเช่าทรัพยากรด้านการประมวลผล (การประมวลผล พื้นที่จัดเก็บข้อมูล ฐานข้อมูล เครือข่าย AI) แทนที่จะต้องดูแลรักษาทรัพยากรเหล่านั้นในสถานที่ของตนเอง โมเดลนี้ทำให้แพลตฟอร์มนี้กลายเป็นแกนหลักของอินเทอร์เน็ต ตั้งแต่บริการสตรีมมิ่งขนาดใหญ่ไปจนถึงแอปพลิเคชันบนมือถือและระบบการชำระเงิน ทุกอย่างขึ้นอยู่กับโครงสร้างพื้นฐานของ AWS ไม่ว่าทางตรงหรือทางอ้อม

เมื่อภูมิภาคสำคัญอย่างUS-EAST-1ประสบปัญหา DNS ผลกระทบจะมหาศาล: บริการต่างๆ ไม่สามารถระบุชื่อโดเมนได้ ฐานข้อมูลไม่สามารถเข้าถึงปลายทางได้ และห่วงโซ่การพึ่งพาขาดตอน ดังนั้น เหตุการณ์เพียงครั้งเดียวอาจลุกลามบานปลายจนเกิดความล้มเหลวในวงกว้างในหลากหลายภาคส่วน เช่น ธนาคาร การศึกษา ความบันเทิง และอีคอมเมิร์ซ

ประสบการณ์นี้เน้นย้ำถึงความจำเป็นในการออกแบบ ระบบ ที่มีความยืดหยุ่นและหลากหลาย: การสำรองข้อมูลข้ามภูมิภาค แผนการสลับระบบเมื่อเกิดข้อผิดพลาด และกลยุทธ์การจัดการเมื่อระบบทำงานผิดปกติ แม้ว่าบริการหลายอย่างจะกลับมาใช้งานได้เร็ว แต่บางบริการก็ใช้เวลานานกว่า ซึ่งแสดงให้เห็นว่าการคาดการณ์สถานการณ์การหยุดชะงักของระบบ มีความสำคัญเพียงใด

แม้ว่าการดำเนินงานส่วนใหญ่จะกลับมาดำเนินการตามปกติแล้ว แต่ทีมงานด้านเทคนิคยังคงตรวจสอบรายละเอียดขั้นสุดท้ายและตรวจสอบให้แน่ใจว่าไม่มีผลข้างเคียงใดๆ เกิดขึ้น บริษัทเน้นย้ำว่า หลังจากแก้ไขสาเหตุหลักแล้ว อาจจำเป็นต้องมี การปรับเปลี่ยน ต่อไป จนกว่าการจราจรในพื้นที่ที่ได้รับผลกระทบจะกลับสู่ภาวะปกติอย่างสมบูรณ์

เหตุการณ์ ในวันนี้ได้ข้อสรุปที่ชัดเจนประการหนึ่งคือ ความผิดพลาด ของ DNSใน US-EAST-1 ส่งผลให้บริการต่างๆ จำนวนมากหยุดชะงัก ตั้งแต่ Amazon.com, AlexaหรือPrime Videoไปจนถึงธนาคารเครื่องรับชำระเงินด้วยบัตร Ticketmaster และวิดีโอเกม โดยมีการแจ้งเตือนตั้งแต่เวลา 08:40 น. และค่อยๆ กลับมาใช้งานได้อีกครั้งตั้งแต่เที่ยง ซึ่งเป็นการย้ำเตือนว่าอินเทอร์เน็ตพึ่งพาโครงสร้างพื้นฐานของ AWS มากเพียงใด

สุดยอดสายปฏิบัติการ Rainbow Six Siege ปี 2021
บทความที่เกี่ยวข้อง:
สุดยอดสายปฏิบัติการ Rainbow Six Siege ปี 2021

เพิ่มเป็นแหล่งข้อมูลที่ต้องการใน Google