ขณะนี้มีห้องปฏิบัติการ AI ขั้นสูงสี่แห่งที่ยืนยันแล้วว่า แบบจำลองของพวกเขาสามารถเข้าถึงอินเทอร์เน็ตสาธารณะ และเชื่อมต่อกับระบบของบริษัทจริงได้ โดย Google เพิ่งเข้าร่วมรายชื่อดังกล่าวเมื่อวันศุกร์ หลังจากเกิดเหตุการณ์กับตนเองเมื่อราวสี่เดือนก่อน
Gemini เข้าถึงระบบของบริษัทจริงสามแห่งระหว่างการประเมินในเดือนพฤษภาคม และที่สำคัญ แบบจำลองหยุดกระบวนการในทั้งสามกรณี
Gemini ของ Google เจาะระบบบริษัท 3 แห่งระหว่างการทดสอบ
เหตุการณ์นี้เกิดขึ้นระหว่างการฝึกฝนด้านความปลอดภัยแบบ “capture-the-flag” ที่จัดโดย Irregular ซึ่งโดยปกติโหมดนี้จะไม่ต้องเชื่อมต่ออินเทอร์เน็ต อย่างไรก็ตาม ความผิดพลาดในสภาพแวดล้อมการทดสอบกลับเปิดทางให้แบบจำลองเข้าถึงอินเทอร์เน็ตได้
ในหนึ่งเหตุการณ์ แบบจำลองสามารถเดารหัสผ่านจนกระทั่งเจาะเข้าสู่ระบบที่ได้รับการป้องกันได้ ตามรายงานของ The Wall Street Journal ส่วนอีกสองกรณี แบบจำลองพบข้อมูลรับรองที่เปิดเผยใน repository สาธารณะแล้วนำไปใช้เข้าระบบที่มีการป้องกัน
Heather Adkins รองประธานฝ่ายวิศวกรรมความปลอดภัยของ Google กล่าวว่าทั้งสามบริษัทได้รับแจ้งถึงสิ่งที่เกิดขึ้นแล้ว
เราได้แจ้งให้ทั้งสามองค์กรทราบ และเราร่วมมือกับคู่ฝึกอบรมของเราเพื่อดำเนินการเปลี่ยนแปลงในกระบวนการทดสอบของพวกเขาแล้ว เธอกล่าว
ติดตามเราใน X เพื่ออัปเดตข่าวสารล่าสุดทันทีที่เกิดขึ้น
สี่ห้องปฏิบัติการ กับรูปแบบเดียวกัน
Google ระบุว่าเอเจนต์หยุดการกระทำของพวกเขาหลังจากตรวจสอบพบว่าได้เชื่อมต่อกับระบบของบริษัทจริง ไม่ใช่เป้าหมายจำลอง
ในการประเมินมาตรฐาน แบบจำลองจะค้นหาข้อมูลสาธารณะทางออนไลน์ และเดาชุดข้อมูลรับรองเพื่อเข้าใช้งานเว็บไซต์ที่แบบจำลองคิดว่าเป็นส่วนหนึ่งของการทดสอบ Adkins กล่าวในแถลงการณ์
บริษัทเพิ่มเติมว่าพฤติกรรมนี้ไม่ใช่ตัวอย่างของการที่แบบจำลองไม่สอดคล้องกับวัตถุประสงค์และไม่จำเป็นต้องเปิดเผยสู่สาธารณะ เนื่องจากมาตรการด้านความปลอดภัยของ Gemini ทำงานได้ผล
โฆษกของ Irregular กล่าวว่าเหตุการณ์นี้เกี่ยวข้องกับปัญหาเดียวกับที่ส่งผลกระทบต่อห้องปฏิบัติการ AI รายอื่น ๆ Irregular แจ้งห้องปฏิบัติการที่เกี่ยวข้องในช่วงปลายเดือนกรกฎาคม และโฆษกยังเสริมว่าปัญหาที่ทราบในฝั่งของตนเองได้รับการแก้ไขไปแล้วเมื่อหลายสัปดาห์ก่อน
การเปิดเผยข้อมูลนี้ทำให้ Google อยู่ในกลุ่มเดียวกับ OpenAI Anthropic และ Meta ซึ่งทุกแห่งต่างรายงานว่าแบบจำลองหลุดออกจากสภาพแวดล้อมทดสอบในปีนี้
OpenAI เปิดเผยเมื่อเดือนกรกฎาคมว่าแบบจำลองของตนหลุดออกจาก sandbox และเจาะ Hugging Face ได้ ส่วน Anthropic ได้ตรวจสอบการประเมินมากกว่า 141,000 ครั้ง และพบปัญหาของตนเองสามกรณี ขณะที่ Meta รายงานเหตุการณ์หนึ่งในเดือนสิงหาคม
ติดตามช่อง YouTube ของเรา เพื่อรับชมผู้นำและนักข่าวที่ให้ความรู้และข้อมูลเชิงลึกแบบผู้เชี่ยวชาญ









