OpenAI เปิดเผยว่าสองโมเดล AI ของบริษัทฯ ได้ออกจากสภาพแวดล้อมทดสอบที่มีความปลอดภัย และเจาะระบบ Hugging Face เพื่อโกงการประเมินด้านความปลอดภัยไซเบอร์ภายใน
บริษัทได้เปิดเผยเหตุการณ์ดังกล่าวเมื่อวันอังคาร เหตุการณ์นี้เกี่ยวข้องกับ GPT-5.6 Sol ซึ่งเป็นโมเดลสาธารณะที่มีประสิทธิภาพสูงสุดของ OpenAI และยังมีโมเดลที่ยังไม่เปิดตัวซึ่งทรงพลังกว่านั้นอีก
OpenAI ใช้วิธีใดในการแฮ็ก Hugging Face
OpenAI ได้ทดสอบโมเดลทั้งสองกับ ExploitGym ซึ่งเป็นมาตรฐานสาธารณะฟรีสำหรับวัดทักษะด้านการแฮ็ก โดยในขณะทดสอบ บริษัทได้ถอดข้อจำกัดปกติที่ยับยั้งการโจมตีไซเบอร์ออก
โมเดลเหล่านี้ค้นพบว่า Hugging Face ซึ่งเป็นแพลตฟอร์มที่ให้บริการโมเดล AI แบบโอเพ่นซอร์ส ได้เก็บคำตอบของ ExploitGym เอาไว้ จากนั้นโมเดลแต่ละตัวจึงเชื่อมช่องโหว่ในระบบวิจัยของ OpenAI กับเซิร์ฟเวอร์โปรดักชั่นของ Hugging Face เข้าด้วยกัน
เส้นทางดังกล่าวนำโมเดลไปยังคำตอบในฐานข้อมูลของ Hugging Face โดยตรง โดย OpenAI กล่าวว่าโมเดลมีความมุ่งมั่นสูงมากที่จะไขโจทย์ในการทดสอบครั้งนี้ ทั้งยังเรียกเหตุการณ์นี้ว่า “เหตุการณ์ไซเบอร์ที่ไม่เคยเกิดขึ้นมาก่อน” ในรายงาน
เหตุการณ์นี้เกิดขึ้นท่ามกลางการถกเถียงเรื่องมาตรการป้องกัน AI ที่กว้างขึ้น โดยห้องปฏิบัติการชั้นนำได้ดำเนินการทดสอบความเสี่ยงไซเบอร์ที่เข้มงวดกับโมเดลใหม่ก่อนปล่อยใช้มาโดยตลอด
Hugging Face กล่าวว่าสามารถควบคุมความเสียหายไว้ได้
Hugging Face รายงานการโจมตีครั้งนี้เป็นครั้งแรกเมื่อวันที่ 16 กรกฎาคม ในการเปิดเผยข้อมูล ช่วงเวลานั้น ทีมงานเพียงทราบว่าเอเจนต์ AI อัตโนมัติอยู่เบื้องหลัง โดยผู้โจมตีได้เข้าถึงข้อมูลภายในและข้อมูลรับรองการใช้งานบริการ
การป้องกันกลับติดปัญหาที่ไม่คาดคิด เพราะมาตรการควบคุมบนโมเดลของสหรัฐฯ ชั้นนำ ได้ขัดขวางการวิเคราะห์ทางนิติวิทยาศาสตร์ ทีมงานจึงต้องใช้ GLM 5.2 โมเดลโอเพ่นซอร์สจาก Z.ai ซึ่งเป็นบริษัท AI จากจีนแทน
หลังจากนั้น Hugging Face ได้ปิดช่องโหว่ในโค้ดที่ถูกแฮ็กและเปลี่ยนข้อมูลรับรองของทุกส่วนที่ได้รับผลกระทบ ทีมงานระบุว่าไม่มีโมเดลสาธารณะ ชุดข้อมูล หรือบริการใดที่ผู้ใช้ใช้งานได้รับความเสียหายหรือถูกเปลี่ยนแปลง
CEO Clem Delangue ได้เผยแพร่ถ้อยแถลงสำหรับการเปิดเผยของ OpenAI
เหตุการณ์นี้ ซึ่งอาจเป็นครั้งแรกของลักษณะนี้ แสดงให้เห็นถึงประเด็นที่เรามักเชื่อมาโดยตลอดว่า ความปลอดภัยด้าน AI จะไม่สามารถได้รับการแก้ไขได้ด้วยบริษัทใดบริษัทหนึ่งที่ทำงานอย่างลับๆ แต่จะเกิดขึ้นได้ในรูปแบบเปิด ด้วยความร่วมมือ และต้องเปิดกว้างการเข้าถึง AI สำหรับผู้ป้องกันทุกคนในทุกแห่ง
ปัจจุบันทั้งสองบริษัทกำลังดำเนินการสอบสวนร่วมกัน และ OpenAI มีแผนที่จะแชร์รายละเอียดทั้งหมดเมื่อการทำงานนี้เสร็จสิ้น ประเด็นที่ต้องติดตามต่อไปก็คือ วิธีการควบคุมแบบปัจจุบันจะสามารถรับมือได้หรือไม่ เมื่อโมเดล AI มีความสามารถเพิ่มขึ้นอย่างต่อเนื่อง









