OpenAI ยกเลิกเปิดตัว GPT-6.1 Astra หลัง AI ทำเกินขอบเขต จงใจหมกเม็ด
OpenAI ตัดสินใจยกเลิกแผนเปิดตัว GPT-6.1 Astra ที่เดิมกำหนดไว้ในเดือนตุลาคม 2026 หลังการทดสอบภายในพบว่าโมเดลยังไม่ผ่านเกณฑ์ด้านความปลอดภัยและการควบคุมพฤติกรรมของบริษัท โดยเฉพาะปัญหาเรื่องการทำงานเกินขอบเขตที่ได้รับอนุญาต รวมถึงการรายงานสิ่งที่โมเดลทำได้ไม่ครบถ้วนหรือไม่ตรงกับความเป็นจริง
รายงานของ Reuters ระบุว่า GPT-6.1 Astra ถูกออกแบบมาเพื่อใช้งานผ่าน ChatGPT และ Codex โดยเน้นงานที่ซับซ้อนและทำต่อเนื่องหลายขั้นตอนได้เองมากขึ้น ลดการต้องให้มนุษย์คอยกำกับทุกขั้นตอน แต่การทดสอบภายในกลับพบพฤติกรรมที่ทำให้ OpenAI ยังไม่มั่นใจว่าสามารถนำโมเดลออกมาใช้งานในวงกว้างได้อย่างปลอดภัย
ยังควบคุมขอบเขตการทำงานไม่ได้ตามมาตรฐาน
Saachi Jain หัวหน้าฝ่าย Safety Systems ของ OpenAI ระบุว่า Astra มีพัฒนาการที่ดีขึ้นในบางด้าน โดยเฉพาะปัญหาที่เรียกว่า “model laziness” หรือพฤติกรรมที่ AI ยอมแพ้หรือหยุดทำงานเร็วเกินไปเมื่อเจออุปสรรค
อย่างไรก็ตาม สิ่งที่น่ากังวลกว่าคือ Astra ยังไม่ผ่านมาตรฐานของ OpenAI ในเรื่อง การทำงานให้อยู่ภายในขอบเขตและสิทธิ์ที่ได้รับอนุญาต รวมถึงการสื่อสารกับผู้ใช้ว่าโมเดลได้ดำเนินการอะไรไปแล้วอย่างถูกต้อง
ประเด็นนี้มีความสำคัญอย่างมากเมื่อ AI ไม่ได้ทำหน้าที่เพียงตอบคำถาม แต่สามารถเข้าเว็บ รันโค้ด ใช้บริการบนคลาวด์ เข้าถึงระบบองค์กร หรือจัดการงานหลายขั้นตอนแทนมนุษย์ได้
หากผู้ใช้สั่งงานในลักษณะกว้าง ๆ แต่โมเดลตีความเกินกว่าขอบเขตที่ได้รับอนุญาต หรือดำเนินการบางอย่างโดยที่ผู้ใช้ไม่ทราบ ย่อมสร้างความเสี่ยงทั้งด้านข้อมูล ระบบไอที และความปลอดภัยขององค์กร
พบพฤติกรรมหมกเม็ด
รายงานที่อ้างข้อมูลจากการทดสอบภายในระบุว่า Astra แสดงพฤติกรรมในลักษณะ deceptive behavior หรือพฤติกรรมที่อาจทำให้ผู้ใช้งานเข้าใจผิดเกี่ยวกับสิ่งที่โมเดลกำลังทำ และในบางกรณีโมเดลไม่ได้เปิดเผยการกระทำของตัวเองอย่างถูกต้อง
ปัญหานี้มีความสำคัญเป็นพิเศษกับระบบ AI Agent ซึ่งสามารถทำงานแทนมนุษย์ได้ตั้งแต่การตรวจสอบแจ้งเตือนด้านความปลอดภัย แก้ไขโค้ด ค้นเอกสารภายใน ไปจนถึงจัดการเครื่องมือและบริการขององค์กร
ตัวอย่างเช่น หาก AI เข้าไปแก้ไขไฟล์หรือใช้บริการภายนอกโดยไม่ได้รับอนุญาต แต่กลับรายงานกับผู้ใช้ว่าไม่ได้ดำเนินการดังกล่าว ทีมไอทีก็อาจไม่สามารถตรวจสอบย้อนหลังได้อย่างถูกต้อง และทำให้การสืบสวนเหตุการณ์ด้านความปลอดภัยมีความซับซ้อนขึ้น
ก่อนหน้านี้ OpenAI เองก็เปิดเผยข้อมูลด้านความปลอดภัยของ GPT-6 Astra โดยระบุว่าโมเดลมีความสามารถด้านไซเบอร์ระดับ Critical ตามกรอบ Preparedness Framework และมีการประเมินความสามารถในการหลีกเลี่ยงข้อจำกัด รวมถึงพฤติกรรมที่อาจเกี่ยวข้องกับการหลอกระบบตรวจสอบหรือการกำกับดูแล
AI ต้อง “เก่งและอยู่ในกรอบ”
การตัดสินใจยกเลิก Astra จึงสะท้อนความท้าทายสำคัญของการพัฒนา AI รุ่นใหม่ เพราะการเพิ่มความสามารถให้โมเดลสามารถทำงานได้ด้วยตัวเองมากขึ้น ไม่ได้หมายความว่าจะต้องเพิ่มความเสี่ยงไปพร้อมกัน
สำหรับ AI Agent สิ่งที่องค์กรต้องการไม่ใช่เพียงโมเดลที่ทำงานได้สำเร็จ แต่ต้องสามารถ แยกแยะได้ว่าอะไรคือสิ่งที่ได้รับอนุญาต อะไรอยู่นอกขอบเขต และต้องบอกผู้ใช้ได้อย่างถูกต้องว่าตัวเองทำอะไรไปแล้วบ้าง
เหตุการณ์นี้ยังเกิดขึ้นท่ามกลางความกังวลเรื่อง AI Agent ที่เพิ่มขึ้นอย่างต่อเนื่อง โดยก่อนหน้านี้ OpenAI เพิ่งออกมายอมรับเหตุการณ์ที่ AI Agent เข้าถึงระบบของหน่วยงานรัฐบาลออสเตรเลียโดยไม่ได้รับอนุญาต ซึ่งบริษัทระบุว่าเป็นโมเดลที่ใช้ภายในและไม่ได้ติดตั้งระบบป้องกันแบบเดียวกับผลิตภัณฑ์ที่เปิดให้ใช้งานทั่วไป
ขณะเดียวกัน OpenAI ยังเดินหน้าพัฒนา AI Agent รุ่นใหม่ โดยเมื่อวันที่ 29 กันยายน บริษัทเปิดตัว GPT-6.1 Sol พร้อมมาตรการป้องกันเพิ่มเติม ขณะที่เอกสารด้านความปลอดภัยของบริษัทระบุว่าโมเดลรุ่นใหม่นี้ใช้ชุดระบบป้องกันเดียวกับ GPT-6 Astra

