October 6, 2026

Anthropic เตือน! โมเดล AI จีน แฮกเก่ง ไล่จี้ AI ระดับแนวหน้าของอเมริกา

Anthropic ออกผลประเมินความปลอดภัยของ GLM-5.3 โมเดล AI แบบ Open-weight จาก Zhipu AI หรือ Z.ai ของจีน พบว่าโมเดลมีความสามารถสูงในการสร้างกระบวนการโจมตีไซเบอร์แบบครบขั้นตอน แต่ระบบป้องกันกลับไม่เข้มงวดนัก ทำให้แฮกเกอร์นำไปใช้ในทางที่ผิด เพื่อหลบข้อจำกัดและสั่งให้ AI ช่วยค้นหาและเจาะช่องโหว่ได้ง่าย

ผลการประเมินของ Anthropic สอดคล้องกับงานวิจัยของ U.S. Center for AI Standards and Innovation (CAISI) ที่ระบุว่า GLM-5.3 เป็น โมเดล Open-weight ที่มีความสามารถด้านไซเบอร์สูงที่สุดเท่าที่เคยเปิดตัวมา แม้ในภาพรวมโมเดล AI ระดับแนวหน้าจากสหรัฐฯ ยังคงทำผลงานได้ดีกว่าในด้านความปลอดภัยไซเบอร์

สร้าง Exploit แบบครบวงจรได้

Anthropic ทดสอบ GLM-5.3 ในสภาพแวดล้อมแบบแยกออกจากระบบจริงและมี Sandbox เพื่อดูว่าโมเดลสามารถค้นหาและใช้ประโยชน์จากช่องโหว่ได้มากน้อยเพียงใด โดยใช้ทั้งการทดสอบอัตโนมัติอย่าง ExploitBench และกระบวนการที่มีมนุษย์ร่วมควบคุม พร้อมนำผลไปเปรียบเทียบกับ Mythos Preview

ผลการทดสอบพบว่า GLM-5.3 และ Mythos Preview มีประสิทธิภาพใกล้เคียงกันในการพัฒนา Exploit แบบ End-to-end โดยสามารถสร้างการโจมตีได้สำเร็จ 50 ครั้ง และ 56 ครั้งตามลำดับ จากความพยายามมากกว่า 400 ครั้ง

สิ่งที่ Anthropic กังวลมากกว่าความสามารถของโมเดล คือ ระบบป้องกันของ GLM-5.3 ที่ถูกหลบเลี่ยงได้ง่าย โดยทีมวิจัยพบว่าสามารถบายพาสระบบป้องกันได้สำเร็จในสัดส่วนประมาณ 63–100% ขึ้นอยู่กับวิธีการที่ใช้

Anthropic ระบุว่าในการทดสอบครั้งเดียวกัน เทคนิคเหล่านี้ไม่สามารถใช้ผ่านระบบป้องกันของ Claude รุ่นที่มี Guardrails ได้ และมองว่าระบบป้องกันที่หละหลวมของ GLM-5.3 ทำให้ผู้โจมตีเข้าถึงความสามารถด้านไซเบอร์ในระดับสูงได้ง่ายขึ้น

จุดแข็งที่กลายเป็นช่องโหว่

GLM-5.3 มีระบบ Guardrails ติดมาด้วย โดยโมเดลจะปฏิเสธคำสั่งที่เห็นได้ชัดว่ามีเจตนาสร้างความเสียหาย แต่ Anthropic พบว่าสามารถหลบเลี่ยงข้อจำกัดดังกล่าวได้ด้วยเทคนิคพื้นฐานเพียงไม่กี่วิธี หนึ่งในวิธีที่ได้ผลมากที่สุดคือ “abiliteration” ซึ่งเป็นเทคนิคที่ใช้ลดหรือกำจัดพฤติกรรมการปฏิเสธคำสั่งของโมเดล โดยไม่จำเป็นต้องฝึกโมเดลใหม่ นักวิจัยสามารถวิเคราะห์รูปแบบที่โมเดลใช้ปฏิเสธคำสั่ง ก่อนแก้ไขค่าน้ำหนักของโมเดลเพื่อลดข้อจำกัดดังกล่าว

ประเด็นสำคัญคือ GLM-5.3 เป็น Open-weight model ที่ผู้ใช้สามารถดาวน์โหลดโมเดลไปใช้งานและแก้ไขได้เอง จึงแตกต่างจากโมเดลแบบปิดที่ผู้ให้บริการเป็นผู้ควบคุมระบบป้องกันอยู่เบื้องหลัง

Anthropic ยังสามารถหลบเลี่ยง Guardrails ได้ด้วยการนำโมเดลเข้าไปอยู่ในสภาพแวดล้อมจำลอง แล้วทำให้โมเดลเข้าใจว่ากำลังทำภารกิจ Red Teaming เพื่อทดสอบความปลอดภัย ซึ่งช่วยให้โมเดลยอมทำงานที่ปกติอาจปฏิเสธ

ช่องว่าง AI จีนกับสหรัฐฯ อาจแคบลงเร็วกว่าที่คิด

Anthropic มองว่าเมื่อ GLM-5.3 มีความสามารถใกล้เคียงกับ Mythos Preview แต่สามารถถอดหรือหลบเลี่ยงระบบป้องกันได้ง่าย โมเดลลักษณะนี้อาจทำให้ ช่องว่างระหว่างความสามารถของฝ่ายโจมตีและฝ่ายป้องกันแคบลงอย่างรวดเร็ว บริษัทเตือนว่า GLM-5.3 อาจทำให้ผู้โจมตีเข้าถึงความสามารถที่ช่วยค้นหาและใช้ช่องโหว่ไซเบอร์ได้โดยแทบไม่มีข้อจำกัด ซึ่งแตกต่างจากโมเดล AI อื่นที่มีความสามารถใกล้เคียงกัน แต่เปิดตัวพร้อมระบบป้องกันที่เข้มงวดกว่า หรือจำกัดการเข้าถึงโมเดล

ที่ผ่านมาอุตสาหกรรมมักประเมินว่าโมเดล Open-weight จากจีนและประเทศอื่น ๆ ยังตามหลังโมเดลแบบปิดจากบริษัท AI ชั้นนำประมาณ 6–8 เดือน แต่ช่องว่างดังกล่าวกำลังถูกบีบให้แคบลงอย่างต่อเนื่อง โดยเฉพาะเมื่อห้องแล็บ AI จีนเข้าถึงข้อมูลสำหรับฝึกโมเดลที่มีคุณภาพมากขึ้น

ขณะเดียวกัน บริษัท AI สหรัฐฯ อย่าง Anthropic และ OpenAI รวมถึงรัฐบาลสหรัฐฯ เคยกล่าวหาบริษัท AI จีนบางราย รวมถึง Z.ai ว่าอาจใช้วิธี Distillation หรือให้โมเดลของบริษัทอื่นสร้างคำตอบและเหตุผล แล้วนำข้อมูลเหล่านั้นไปใช้ฝึกโมเดลของตัวเอง

ที่มา