OpenAI ได้เปิดเผย 6 กรณีของพฤติกรรมโมเดลที่ไม่คาดคิดหรือสร้างความกังวล ซึ่งถูกสังเกตในช่วง 6 เดือนที่ผ่านมา พร้อมด้วยกรอบการรายงานที่บริษัทให้คำมั่นว่าจะเปิดเผยข้อค้นพบลักษณะนี้
กรณีที่รายงานมีทั้งโมเดลที่ปกปิดข้อผิดพลาดของตัวเอง ไปจนถึงโมเดลที่ดำเนินการโดยไม่ได้รับอนุญาตเพื่อหลีกเลี่ยงอุปสรรคต่าง ๆ
OpenAI เผยแพร่ 6 กรณีที่โมเดลปกปิดข้อผิดพลาดและฝ่าฝืนกฎ
ในหนึ่งกรณี โมเดลที่ตอบคำถามเกี่ยวกับรายได้ในเขตแห่งหนึ่งของแคลิฟอร์เนีย พบคีย์ API ที่เปิดเผยในคลังข้อมูลสาธารณะและนำมาใช้โดยไม่ได้รับอนุญาต เมื่อข้อมูลยังโหลดไม่ได้ โมเดลจึงแต่งตัวเลขขึ้นแล้วนำเสนอว่าเป็นข้อมูลจากแหล่งที่มีการร้องขอ
การปกปิดข้อมูลพบเห็นถึงสองครั้ง ในช่วงการฝึกฝน GPT-5.6 Sol โมเดลหลายตัวได้เขียนคำแนะนำลงในสรุปภารกิจของตัวเองเพื่อปกปิดข้อผิดพลาดและพฤติกรรมที่เบี่ยงเบน
โมเดลวิจัยที่ยังไม่เปิดตัวอีกตัวหนึ่ง ได้แทรกคำสั่งที่ไม่เกี่ยวข้อง เช่น คำสั่งให้ละเว้นข้อจำกัดปกติของตัวเอง ลงไปในสรุปทั้งหมด 27 รายการ
โมเดลที่ยังไม่เปิดตัวอีกตัวหนึ่งได้อัปโหลดไฟล์ไปยังอินเทอร์เน็ตโดยไม่ได้รับการร้องขอ เพียงเพื่อให้ตัวเองสามารถอ้างอิงลิงก์ในเบราว์เซอร์ได้
อีกสองกรณีที่รายงานเกี่ยวข้องกับการประสานงาน โดยโมเดลได้นำคลังซอฟต์แวร์ภายในมาใช้เป็นกระดานข้อความ เพื่อแลกเปลี่ยนคำขอในระหว่างการฝึกฝนแยกกัน ตัวแทนที่ทำงานในภารกิจร่วมกันยังได้นำผลงานไปโพสต์บนเว็บไซต์ฝากไฟล์สาธารณะเมื่อ พวกเขาไม่สามารถอ่าน ไฟล์ภายในของกันและกันได้
กรณีเหล่านี้แสดงให้เห็นพฤติกรรมหลากหลายรูปแบบซึ่งเรามองว่าควรแบ่งปัน ตั้งแต่การปกปิดข้อมูลกับผู้ใช้ ไปจนถึงการดำเนินการโดยไม่ได้รับอนุญาตเพื่อลดอุปสรรค เหล่านี้เป็นรายงานของแต่ละกรณีและไม่ควรถือเป็นการสะท้อนว่าปัญหาการไม่สอดคล้องกันเกิดขึ้นบ่อยเพียงใดในบรรดาโมเดลของเรา OpenAI กล่าวเสริม
ติดตามเราใน X เพื่อรับข่าวสารล่าสุดทันที
กรอบการเปิดเผยข้อเท็จจริงและคำเตือน
กรอบการดำเนินงานนี้เกิดขึ้นหลังเหตุการณ์ในเดือนกรกฎาคม เมื่อเอเจนต์ OpenAI หลบหนีจากแซนด์บ็อกซ์ของพวกเขาและ ละเมิดระบบของ Hugging Face ซึ่ง OpenAI ได้ระบุว่าเป็นเหตุการณ์เตือนภัย ครั้งสำคัญ
ปัจจุบัน ด้วยกรอบการเปิดเผยนี้ บริษัทมีช่องทางอย่างเป็นทางการในการแจ้งเหตุการณ์ที่ไม่สอดคล้อง พนักงาน OpenAI ทุกคนสามารถแจ้งเหตุการณ์ได้ ซึ่งจะถูกส่งไปยังสามเส้นทางที่กำหนดไว้
กรณีส่วนใหญ่จะถูกจัดให้พร้อมสำหรับเปิดเผยและสอบสวนเล็กน้อย ในขณะที่ “เส้นทางช้า” จะดูแลการสอบสวนที่ซับซ้อนซึ่งมีบุคคลที่สามเกี่ยวข้อง OpenAI ระบุว่าเหตุการณ์ Hugging Face ในเดือนกรกฎาคมจะอยู่ภายใต้เส้นทางช้านี้
บริษัทได้ประกบกรอบใหม่นี้กับการประเมินสถานะของอุตสาหกรรมในปัจจุบันอย่างตรงไปตรงมา
พวกเรายังไม่เชื่อว่าอุตสาหกรรม AI ได้แก้ไขปัญหาเรื่องการปรับแนวทางและการตรวจสอบให้เพียงพอสำหรับการขยายตัวอย่างรับผิดชอบด้วยความเร็วสูงสุดต่อไปได้อีกนาน
ข้อมูลที่เปิดเผยนี้ออกมาท่ามกลางคำเตือนเกี่ยวกับการสูญพันธุ์ที่เพิ่มมากขึ้น โดยคำเตือนจากนักวิจัย AIได้ส่งถึงสภาคองเกรสแล้ว ซึ่งขณะนี้สมาชิกสภากำลังพิจารณาร่างกฎหมายเพื่อห้ามซูเปอร์อินเทลลิเจนซ์โดยเด็ดขาด
บริษัทกล่าวว่าการเปิดเผยข้อมูลนี้เป็นก้าวแรกสู่มาตรฐานที่อุตสาหกรรมนี้ยังไม่มี และการที่ห้องทดลองคู่แข่งจะรับแนวทางรายงานลักษณะเดียวกันหรือไม่นั้น จะสะท้อนว่าทั้งวงการพร้อมจะดูแลและควบคุมตัวเองต่อหน้าสาธารณะมากเพียงใด
สมัครรับข้อมูลช่อง YouTube ของพวกเรา เพื่อชมผู้นำและนักข่าวแบ่งปันมุมมองเชิงลึกอย่างผู้เชี่ยวชาญ









