โมเดล AI รายใหญ่หลายค่ายล่มพร้อมกันแบบผิดปกติ
เมื่อวันพฤหัสบดี ระบบบริการ AI บนคลาวด์ของผู้ให้บริการรายใหญ่หลายรายเกิดเหตุขัดข้องพร้อม ๆ กันในช่วงเวลาไล่เลี่ยงกันหลายชั่วโมง ซึ่งถือเป็นเหตุการณ์ที่เกิดไม่บ่อยนักสำหรับแพลตฟอร์มระดับนี้ ทั้ง OpenAI…

เมื่อวันพฤหัสบดี ระบบบริการ AI บนคลาวด์ของผู้ให้บริการรายใหญ่หลายรายเกิดเหตุขัดข้องพร้อม ๆ กันในช่วงเวลาไล่เลี่ยงกันหลายชั่วโมง ซึ่งถือเป็นเหตุการณ์ที่เกิดไม่บ่อยนักสำหรับแพลตฟอร์มระดับนี้ ทั้ง OpenAI, Anthropic, xAI และ Google ต่างมีรายงานปัญหาการให้บริการในช่วงเช้าวันเดียวกัน สะท้อนว่าระบบ AI สมัยใหม่แม้จะกระจายอยู่บนโครงสร้างพื้นฐานขนาดใหญ่ แต่ก็ยังเสี่ยงต่อความไม่เสถียรในระดับที่ส่งผลต่อผู้ใช้จำนวนมากได้ในเวลาใกล้เคียงกัน
ฝั่ง Anthropic เป็นรายแรกที่แจ้งเหตุ โดยระบุว่า Claude หลายรุ่นเริ่มมีอัตราความผิดพลาดสูงกว่าปกติในคำขอใช้งาน ทำให้บริการบางส่วนใช้งานได้ไม่เต็มประสิทธิภาพ บริษัทตรวจพบปัญหาได้ค่อนข้างเร็ว และภายในไม่นานก็ประกาศว่าเจอสาเหตุแล้ว ก่อนจะทยอยปล่อยแพตช์แก้ไขจนสถานการณ์กลับสู่ภาวะปกติในช่วงเที่ยงกว่า นอกจากนี้ยังมีรายงานเหตุขัดข้องอีกระลอกสั้น ๆ ที่กระทบ Claude อีกรุ่นหนึ่งหลังจากนั้นไม่นาน
OpenAI ก็เผชิญปัญหาในลักษณะคล้ายกัน โดยผู้ใช้งาน ChatGPT และ Codex พบความผิดพลาดสูงขึ้นและประสิทธิภาพโดยรวมลดลงในช่วงสาย บริษัทตอบสนองด้วยมาตรการบรรเทาอาการผิดปกติ ก่อนจะประกาศว่าปัญหาได้รับการแก้ไขในช่วงบ่าย เหตุการณ์นี้ชี้ว่าแม้บริการ AI ที่คนใช้แพร่หลายจะมีระบบสำรองและการควบคุมคุณภาพระดับสูง แต่ก็ยังอาจสะดุดได้เมื่อมีปัญหาบางจุดในระบบหลังบ้าน
แม้บทความจะเน้นรายงานจาก Anthropic และ OpenAI เป็นหลัก แต่ภาพรวมของเหตุการณ์คือการที่ผู้ให้บริการโมเดล AI ชั้นนำหลายเจ้ามีปัญหาใกล้เคียงกันในวันเดียว ซึ่งนับว่าไม่ธรรมดาและอาจกระทบความเชื่อมั่นของผู้ใช้ที่พึ่งพา AI เป็นเครื่องมือทำงานประจำวัน เหตุขัดข้องแบบนี้ยังสะท้อนความท้าทายของอุตสาหกรรม AI ที่กำลังเติบโตอย่างรวดเร็ว ทั้งในด้านความพร้อมของระบบ ความทนทานต่อความผิดพลาด และการรักษาบริการให้เสถียรเมื่อมีผู้ใช้งานจำนวนมากพร้อมกัน
สำหรับผู้ใช้งานทั่วไป เหตุการณ์ดังกล่าวเป็นเครื่องย้ำว่าบริการ AI เชิงคลาวด์ยังไม่ได้มีความพร้อมใช้งานแบบไร้รอยต่อเสมอไป และการพึ่งพาเครื่องมือประเภทนี้ในการทำงานสำคัญควรมีแผนสำรองไว้ด้วย ขณะเดียวกัน สำหรับผู้ให้บริการ เหตุการณ์ลักษณะนี้น่าจะทำให้การลงทุนด้านความเสถียรของระบบ การตรวจจับปัญหาอัตโนมัติ และการสื่อสารสถานะบริการกับผู้ใช้มีความสำคัญยิ่งขึ้น


