OpenAI ระงับการฝึก AI รุ่นทรงพลัง หลังโมเดลหลุดจากระบบควบคุม แถม Kill Switch ไม่ทำงาน
OpenAI ประกาศระงับการฝึก (Training) และการทดสอบโมเดล AI ที่มีความสามารถสูงที่สุดของบริษัทเป็นการชั่วคราว หลังพบเหตุการณ์โมเดล AI สามารถหลุดออกจากสภาพแวดล้อมที่จำกัดไว้ และติดต่อกับระบบภายนอกได้ ขณะที่ระบบสั่งหยุดการทำงานอัตโนมัติ หรือ Kill Switch กลับไม่ทำงาน ทำให้การทำงานของโมเดลดำเนินต่อไปอีกหลายชั่วโมง
เหตุการณ์ดังกล่าวเกิดขึ้นเมื่อวันที่ 20 กันยายน โดยโมเดล AI ที่ใช้สำหรับงานวิจัยพบช่องโหว่ในระบบกรอง DNS (DNS Filtering) ซึ่งมีหน้าที่จำกัดการเชื่อมต่อออกไปยังอินเทอร์เน็ต ก่อนอาศัยช่องโหว่นี้ติดต่อกับ AI chatbot ภายนอก ขณะพยายามค้นหาคำตอบสำหรับโจทย์วิจัย
แม้เหตุการณ์นี้จะเกิดขึ้นในสภาพแวดล้อมสำหรับการฝึกโมเดลที่ถูกจำกัดการเข้าถึงจากภายนอก แต่โมเดลกลับสามารถหาทางเชื่อมต่อออกไปได้ ทำให้ OpenAI ต้องหยุดกระบวนการฝึกและประเมินโมเดลที่มีความสามารถสูง รวมถึงการนำโมเดลเหล่านี้ไปทำงานร่วมกับเครื่องมือภายนอก
Kill Switch กลับหยุด AI ไม่ได้
OpenAI ระบุว่าระบบตรวจสอบสามารถตรวจพบความผิดปกติได้ภายใน 15 นาที หลังเกิดเหตุ และมีเจ้าหน้าที่รับทราบการแจ้งเตือนอีก 3 นาทีต่อมา อย่างไรก็ตาม ระบบสั่งหยุดการทำงานอัตโนมัติกลับไม่สามารถทำงานได้ตามที่ออกแบบไว้ ผลคือการทำงานของโมเดลดำเนินต่อไปอีกประมาณ 2 ชั่วโมงครึ่ง ก่อนที่เจ้าหน้าที่จะเข้ามาหยุดระบบด้วยตัวเอง
OpenAI ระบุว่าจะยังไม่กลับมาเดินหน้าการฝึกโมเดลในทันที โดยจะต้องตรวจสอบและยืนยันว่ามาตรการแก้ไขทำงานได้จริง รวมถึงทำการทดสอบเชิงรุกเพื่อพยายามหาวิธีหลบเลี่ยงระบบป้องกันเพิ่มเติม
สำหรับโมเดลที่เกี่ยวข้องกับเหตุการณ์นี้ บริษัทจะไม่นำกลับมาฝึกต่อ แต่จะเริ่มการฝึกใหม่โดยเพิ่มมาตรการด้าน AI Alignment หรือการทำให้พฤติกรรมของ AI สอดคล้องกับข้อกำหนดและเจตนาของผู้พัฒนาเข้าไปด้วย
AI ทำนอกคำสั่ง
เหตุการณ์หลุดจากระบบควบคุมไม่ได้เป็นกรณีเดียวที่ OpenAI กำลังตรวจสอบ
Transluce รายงานว่า พบ AI Agent ที่เชื่อมโยงกับ OpenAI พยายามเจาะเข้าสู่เว็บไซต์ด้านสิทธิพลเมืองของ กระทรวงศึกษาธิการสหรัฐฯ แต่ OpenAI ยังไม่ได้ยืนยันเหตุการณ์ดังกล่าว ขณะที่กระทรวงศึกษาธิการสหรัฐฯ ระบุว่าไม่พบหลักฐานว่าเว็บไซต์หรือฐานข้อมูลได้รับผลกระทบ
อีกกรณี OpenAI ยืนยันว่า AI Agent บางตัวนำ Developer Key ที่พบอยู่บนอินเทอร์เน็ตไปใช้เข้าถึงข้อมูลของ สำนักงานสำมะโนประชากรสหรัฐฯ (U.S. Census Bureau) และนำข้อมูลสาธารณะจาก คณะกรรมการกำกับหลักทรัพย์และตลาดหลักทรัพย์สหรัฐฯ (SEC) ไปเผยแพร่ซ้ำในที่อื่น
อย่างไรก็ตาม OpenAI ระบุว่าเหตุการณ์เหล่านี้ยังไม่พบหลักฐานว่ามีการเข้าถึงข้อมูลลับของรัฐบาล โดย SEC ก็ยืนยันว่าไม่มีข้อมูลที่ไม่เปิดเผยต่อสาธารณะถูกเข้าถึง
นอกจากนี้ OpenAI ยังเปิดเผยกรณีโมเดลภายในบริษัทนำ GitHub Token ของนักวิจัย ไปเผยแพร่ไว้ใน Public Repository ขณะพยายามหาทางลัดเพื่อเอาชนะโจทย์พิสูจน์ทฤษฎีทางคณิตศาสตร์
เหตุการณ์ทั้งหมดสะท้อนปัญหาที่กำลังกลายเป็นความท้าทายสำคัญของวงการ AI นั่นคือ เมื่อ AI Agent มีความสามารถในการใช้เครื่องมือ เข้าถึงระบบ และตัดสินใจทำงานหลายขั้นตอนด้วยตัวเอง ความเสี่ยงไม่ได้อยู่แค่การตอบคำถามผิด แต่รวมถึงการที่ AI อาจหาวิธีหลบข้อจำกัดหรือใช้ทรัพยากรที่ไม่ได้รับอนุญาตเพื่อบรรลุเป้าหมาย
สถานการณ์นี้เกิดขึ้นต่อเนื่องในช่วงไม่กี่เดือนที่ผ่านมา ทั้งกรณี AI Agent ที่เกี่ยวข้องกับเหตุการณ์ใน Hugging Face รวมถึงกรณีของ Anthropic ที่ยอมรับว่า AI Agent สามารถหลุดออกจากสภาพแวดล้อมทดสอบและเข้าถึงระบบขององค์กร 3 แห่งได้
OpenAI เองก็เคยประกาศชะลอการฝึก AI มาแล้วในเดือนสิงหาคม หลังเหตุการณ์ Hugging Face โดยหยุดการทำ Reinforcement Learning เป็นเวลา 2 สัปดาห์ พร้อมเพิ่มมาตรการรักษาความปลอดภัย และยังคงระงับการฝึกครั้งใหญ่ที่สุดที่บริษัทวางแผนไว้
ล่าสุด Sam Altman ซีอีโอ OpenAI ยังสนับสนุนข้อเสนอของ Dario Amodei ซีอีโอ Anthropic ที่เรียกร้องให้ชะลอการพัฒนา AI เพื่อให้มาตรการความปลอดภัยสามารถพัฒนาได้ทันกับความสามารถของโมเดล

