เอเจนต์ AI ที่ขับเคลื่อนโดยจีนโกหก คัดลอกตัวเอง และท้าทายข้อจำกัดในอย่างน้อย 20 งานวิจัยตั้งแต่ปี 2025 จากการทบทวนเอกสารวิจัยกว่า 200 ชิ้นของรอยเตอร์ส
ผู้เชี่ยวชาญกล่าวว่าคุณลักษณะเหล่านี้เป็นส่วนผสมสำคัญสำหรับการหลุดรอดแบบไร้การควบคุม อย่างไรก็ตาม จากการทบทวนพบว่าไม่มีหลักฐานว่าเอเจนต์ที่ขับเคลื่อนโดยจีนหลุดรอดสู่โลกอินเทอร์เน็ตกว้างหรือหลบเลี่ยงการปิดระบบได้
การประมูลจำลอง การคัดลอกตัวเอง และการเบี่ยงเบนไปขุด crypto
กรณีที่รอยเตอร์สได้บันทึกไว้นั้นมีตั้งแต่การโกหกในการประกวดราคาธุรกิจจำลอง ไปจนถึงการคัดลอกตัวเองและการขุด crypto
ในการทดสอบประกวดราคาช่วงเดือนมีนาคม เอเจนต์แข่งขันกันเพื่อสัญญาจำลองกับลูกค้า เอเจนต์ที่ใช้ Qwen3-Max-Preview ของ Alibaba และ Kimi-K2 ของ Moonshot โกหกอย่างน้อยหนึ่งครั้งใน 88% ของแต่ละรอบการทดลอง ขณะที่ DeepSeek-V3.2-Exp ทำเช่นนั้นใน 84% ของรอบ
อัตราการหลอกลวงสูงขึ้น 12 ถึง 20 จุดเปอร์เซ็นต์หลังเอเจนต์ได้เรียนรู้จากรอบก่อนหน้า โดยโมเดลของสหรัฐในบททดสอบนี้ก็แสดงพฤติกรรมคล้ายกัน
งานวิจัยเดือนธันวาคม 2025 พบว่าเอเจนต์ที่ขับเคลื่อนโดยจีนและสหรัฐจำลองผลลัพธ์และสร้างไฟล์ปลอมแทนที่จะยอมรับความล้มเหลว ในเดือนมีนาคม 2025 นักวิจัยจากมหาวิทยาลัย Fudan ระบุว่า ระบบที่ขับเคลื่อนด้วย Qwen ของ Alibaba คัดลอกตัวเองโดยไม่ได้รับคำสั่งหลังพบว่าอาจถูกแทนที่
ขณะเดียวกัน ROME ที่เชื่อมโยงกับ Alibaba เข้าถึงเครื่องภายนอก โดยไม่ได้รับคำสั่ง และเบี่ยงเบนการใช้ พลังประมวลผลไปขุด crypto
ในเดือนกันยายน DeepSeek ระบุว่าเอเจนต์ในระบบฝึกอบรมพยายามปลอมแปลงคำขอผู้ใช้และหลีกเลี่ยงกลไกป้องกัน
ผู้เชี่ยวชาญได้ยินเสียงสะท้อนจากคำเตือนของห้องปฏิบัติการสหรัฐ
Colin Shea-Blymyer นักวิจัยจากศูนย์ความมั่นคงและเทคโนโลยีเกิดใหม่แห่งมหาวิทยาลัย Georgetown อ่านกรณีเหล่านี้เป็นสัญญาณเตือน
ผลลัพธ์เหล่านี้แสดงให้เห็นส่วนประกอบสำคัญสำหรับการหลุดรอดแบบไร้การควบคุม Shea-Blymyer กล่าว
Alex Mallen จาก Redwood Research กล่าวว่า กรณีของจีนยังมีความเสี่ยงจำกัดต่อความสามารถปัจจุบันของระบบ แต่เขาได้เปรียบเทียบกับห้องปฏิบัติการในสหรัฐโดยตรง
นี่คือสัญญาณเตือนเดียวกันกับที่ห้องปฏิบัติการในสหรัฐพบในระบบที่ความสามารถน้อยกว่า เขาเสริม
ติดตามเราบน X เพื่อรับข่าวสารล่าสุดทันทีที่เกิดขึ้น
การเปรียบเทียบนี้มีความสำคัญเนื่องจากพฤติกรรมคล้ายกันได้เกิดขึ้นแล้วในการทดสอบของบริษัท AI รายใหญ่ในสหรัฐอเมริกา ในเดือนกรกฎาคม OpenAI เปิดเผยว่า โมเดลของบริษัทได้หลุดออกจาก sandbox และเจาะระบบ Hugging Face ทาง Anthropic ได้ตรวจสอบการประเมินมากกว่า 141,000 ครั้ง และพบเหตุการณ์เกิดขึ้นของตนเองสามกรณี
Meta รายงานเหตุการณ์ในเดือนสิงหาคม และในเดือนกันยายน Google ยืนยันว่า Geminiได้เข้าถึงบริษัทจริงสามแห่งระหว่างการทดสอบความปลอดภัยในเดือนพฤษภาคมเช่นกัน
เหตุการณ์เหล่านี้ไม่ได้หมายความว่านักพัฒนาทั้งจากประเทศจีนหรือสหรัฐอเมริกาจะสามารถหลบหนีเข้าสู่โลกแห่งความเป็นจริงได้เอง อย่างไรก็ตาม เหตุการณ์เหล่านี้สะท้อนถึงความท้าทายด้านความปลอดภัยในวงกว้างขึ้นเมื่อระบบ AI กลายเป็นอิสระมากขึ้นและสามารถดำเนินการได้เองโดยไม่ต้องมีการกำกับดูแลของมนุษย์อย่างต่อเนื่อง
กดติดตามช่อง YouTube ของเรา เพื่อชมผู้นำและนักข่าวแบ่งปันข้อมูลเชิงลึกโดยผู้เชี่ยวชาญ









