ไทย

การประเมินไซเบอร์ของสหรัฐฯ ชี้ Kimi K3 ตามหลังโมเดล AI ชั้นนำของอเมริกา: ข้อเท็จจริงหรือการเมือง?

  • รัฐบาลสหรัฐฯ เผยผลทดสอบ Kimi K3 ยังตามหลัง AI ชั้นนำของอเมริกาเรื่องการแฮ็ก
  • แต่ในสหรัฐอเมริกาทำการทดสอบโมเดลโดยปิดฟิลเตอร์ความปลอดภัย ต่างจาก Kimi K3
  • แนวป้องกันของมันยังช่วยเรื่องการแฮ็กได้ ก่อนเปิดตัวสู่สาธารณะ
Promo

รัฐบาลสหรัฐอเมริกาได้นำโมเดล AI ตัวใหม่ล่าสุดของจีนมาทดสอบด้านความปลอดภัยไซเบอร์ และพบว่า Kimi K3 ของ Moonshot AI ยังด้อยกว่ารุ่นชั้นนำของสหรัฐอเมริกาอย่างมาก

ศูนย์มาตรฐานและนวัตกรรม AI (CAISI) ของสหรัฐอเมริกาได้ดำเนินการทดสอบร่วมกับพันธมิตรจากสหราชอาณาจักร โดยผลการทดสอบนี้ถูกเผยแพร่เพียงหนึ่งวันหลังจากที่วอชิงตันกล่าวหา Moonshot ว่าสร้าง Kimi K3 ด้วยเทคโนโลยีของสหรัฐอเมริกาที่ถูกขโมยไป

ผู้สนับสนุน
ผู้สนับสนุน

Kimi K3 ยังไม่ได้มาตรฐานไซเบอร์ของสหรัฐอเมริกา

กระทรวงพาณิชย์เปิดเผยผลทดสอบในวันพฤหัสบดี โดยระบุว่า Kimi K3 อยู่ในอันดับที่ต่ำกว่ารุ่น AI ชั้นนำของสหรัฐอเมริกาอย่างเห็นได้ชัด อ้างอิงจากการทดสอบร่วมกับผู้เชี่ยวชาญจากสหราชอาณาจักร ดูรายละเอียดได้ที่นี่

Moonshot เปิดตัว Kimi K3 เมื่อวันที่ 16 กรกฎาคม โดยมีความต้องการสูงมากจนบริษัทต้อง ระงับการสมัครใหม่ภายในเวลาเพียงสองวัน

เมื่อเปิดตัวก็ ส่งผลต่อหุ้นชิปของสหรัฐอเมริกาและทำให้เกิดข้อสงสัยใหม่ๆ เกี่ยวกับความเป็นผู้นำด้าน AI ของสหรัฐอเมริกาอีกด้วย

การทดสอบหนึ่งที่เรียกว่า ExploitBench ใช้ช่องโหว่ของเบราว์เซอร์ Chrome จริงซึ่งสร้างขึ้นโดยมหาวิทยาลัย Carnegie Mellon Kimi K3 ได้คะแนน 32% ซึ่งสูงกว่า GLM-5.2 ของจีนที่ได้ 24% อย่างไรก็ตามมันยังคงตามหลังรุ่นชั้นนำของสหรัฐอเมริกาซึ่งได้คะแนนเฉลี่ยประมาณ 76%

ความสามารถในการพัฒนาช่องโหว่โจมตี
การทดสอบด้านเกณฑ์วัดความสามารถในการพัฒนาช่องโหว่โจมตี ที่มา: NIST
ผู้สนับสนุน
ผู้สนับสนุน

ขั้นตอนที่ยากที่สุดคือการควบคุมเครื่องเป้าหมายได้อย่างสมบูรณ์ Kimi K3 ล้มเหลวกับการทดสอบทั้ง 41 ครั้ง ขณะที่รุ่นชั้นนำของสหรัฐอเมริกาสามารถทำได้ถึง 20 ครั้ง

อีกการทดสอบหนึ่งที่เรียกว่า The Last Ones เป็นการโจมตีเครือข่ายบริษัทจำลองที่มี 32 ขั้นตอน ผู้เชี่ยวชาญต้องใช้เวลาประมาณ 20 ชั่วโมงเพื่อทำให้เสร็จ Kimi K3 ไปได้ถึงขั้นที่ 17 โดยเฉลี่ย ในขณะที่รุ่นชั้นนำของสหรัฐอเมริกาไปได้ถึงขั้นที่ 28.5 Kimi K3 ทำทุกขั้นสำเร็จจบกระบวนการเพียง 1 ครั้งจาก 10 ครั้ง

ส่วนรุ่นชั้นนำของสหรัฐอเมริกานั้น มีรายงานว่าสามารถทำได้สำเร็จ 6 หรือ 7 ครั้ง

แต่ช่องว่างอาจดูห่างกว่าความเป็นจริง

แต่ตัวเลขที่เห็นอาจไม่ได้สะท้อนเรื่องราวทั้งหมด รายงานเองยังระบุรายละเอียดเล็กน้อยที่ควรพิจารณา

ก่อนอื่น แบบจำลองของสหรัฐฯ ถูกทดสอบโดยปิดตัวกรองความปลอดภัย ซึ่งการตั้งค่านี้จะแสดงศักยภาพสูงสุด แต่เวอร์ชันสำหรับสาธารณะยังเปิดตัวกรองนี้อยู่ ดังนั้นคะแนนของสหรัฐฯ จึงเป็นเพียงกรณีที่ดีที่สุด ไม่ใช่สถานการณ์จริง

ทีมงานยังระบุว่างานนี้ยังอยู่ในช่วงต้นและมีข้อจำกัด โดยประเมิน Kimi K3 เพียงการทดสอบเดียวเท่านั้น และดำเนินการทดสอบเพียงบางส่วน นั่นทำให้การจัดอันดับยังไม่น่าเชื่อถือ การทดสอบบางรายการยังเป็นความลับ ทำให้คนนอกไม่สามารถตรวจสอบได้

นอกจากนี้ยังมีความไม่สอดคลื้นพื้นฐาน Kimi K3 เป็นโมเดลเปิดที่ใครๆ ก็สามารถดาวน์โหลดได้ ในขณะที่แบบจำลองของสหรัฐฯ เป็นระบบปิดและเป็นส่วนตัว สถาบันในสหราชอาณาจักร พบว่า โมเดลเปิดมักจะตามหลังระบบปิดที่ดีที่สุดประมาณสี่ถึงเจ็ดเดือน และจะให้ Kimi K3 ผ่านการทดสอบเต็มรูปแบบก็ต่อเมื่อ Moonshot ปล่อยออกสู่สาธารณะแล้วเท่านั้น

การทดสอบเหล่านี้ก็ไม่ใช่การโจมตีจริงด้วย เครือข่ายจำลองก็ไม่มีผู้ป้องกันที่เป็นมนุษย์หรือระบบเตือนภัย อย่างไรก็ตาม Kimi K3 กลับสามารถเอาชนะโมเดลเปิดตัวก่อนหน้านี้ได้ และยังสามารถทำการโจมตีเต็มรูปแบบได้หนึ่งครั้ง

ช่วงเวลาและแหล่งที่มาก็ยังทำให้เกิดข้อสงสัย CAISI เคยเป็นสถาบัน AI Safety Institute ของสหรัฐฯ รัฐบาลทรัมป์ ได้เปลี่ยนชื่อสถาบันในเดือนมิถุนายน 2025 และยังอยู่ในกระทรวงเดียวกันกับที่จำกัดการขายชิปของสหรัฐฯ ไปยังจีน รายงานเกี่ยวกับคู่แข่งจากจีนก็ออกมาหลังจากมีข้อกล่าวหาเรื่องการขโมยเทคโนโลยีเพียงหนึ่งวันเท่านั้น

มาตรการป้องกันที่อ่อนแอยังคงเพิ่มความเสี่ยง

แต่คะแนนต่ำไม่ได้แปลว่า Kimi K3 ปลอดภัย การทดสอบพบว่าแนวป้องกันไม่ได้กันไม่ให้พยายามสร้างแฮ็กหรือโจมตีระบบเลย

ซึ่งเรื่องนี้สำคัญเพราะสิ่งที่จะเกิดขึ้นต่อไป Moonshot วางแผนจะปล่อยโมเดลแบบเต็มในวันที่ 27 กรกฎาคม พอปล่อยออกมาแล้วจะดึงกลับคืนไม่ได้ ใครๆ ก็สามารถดาวน์โหลดและถอดตัวกรองความปลอดภัยออกได้

การทดสอบนี้ก็เกิดขึ้นหลังจากมีการอ้างว่าขโมยเทคโนโลยี ฝ่ายวอชิงตันระบุว่า Moonshot สร้าง Kimi K3 ขึ้นบน เทคโนโลยี AI ของสหรัฐฯ ที่ถูกขโมยมา หัวหน้าฝ่ายเทคโนโลยีของทำเนียบขาว Michael Kratsios ระบุว่าบริษัทแอบลอก Claude Fable 5 ของ Anthropic ขั้นตอนนี้ชื่อ distillation คือฝึกโมเดลใหม่โดยอาศัยคำตอบของโมเดลที่แข็งแกร่งกว่า

ทาง Anthropic ก็สนับสนุนข้อกล่าวหานี้ ในเดือนกุมภาพันธ์ บริษัท ตรวจสอบพบ แชทจาก Claude กว่า 3.4 ล้านครั้งที่เกี่ยวข้องกับ Moonshot ผ่านบัญชีปลอมหลายร้อยบัญชี และเตือนว่าตัวโมเดลที่ลอกมานั้นจะสูญเสียการควบคุมด้านความปลอดภัยจากต้นฉบับ นี่คือจุดอ่อนเดียวกับที่ผลทดสอบนี้พบ

สหรัฐฯ ยังใช้จ่ายใน AI มากกว่าจีน 23 เท่า แต่ห้องปฏิบัติการของจีนก็ยังคงไล่ตามช่องว่างได้เรื่อยๆ การทดสอบที่แท้จริงจะเกิดขึ้นเมื่อ Kimi K3 เปิดสู่สาธารณะและผู้เชี่ยวชาญภายนอกสามารถตรวจสอบข้อกล่าวหาได้ด้วยตนเอง


อ่านบทวิเคราะห์ตลาดคริปโตล่าสุดจาก BeInCrypto ได้ที่ คลิกที่นี่.

ข้อจำกัดความรับผิดชอบ

หมายเหตุบรรณาธิการ: เนื้อหาต่อไปนี้ไม่ได้สะท้อนถึงมุมมองหรือความคิดเห็นของ BeInCrypto มันจัดทำขึ้นเพื่อวัตถุประสงค์ในการให้ข้อมูลเท่านั้นและไม่ควรถูกตีความว่าเป็นคำแนะนำทางการเงิน กรุณาทำการวิจัยของคุณเองก่อนที่จะทำการตัดสินใจลงทุนใดๆ และโปรดอ่าน ข้อกำหนดและเงื่อนไข, นโยบายความเป็นส่วนตัว และ ข้อจำกัดความรับผิดชอบ ของเรา

ผู้สนับสนุน
ผู้สนับสนุน