Google และ Meta ได้เปิดตัวโมเดล AI แนวหน้าล่าสุดของพวกเขาภายในเวลาไม่กี่ชั่วโมงในวันพุธนี้ โดย Google เปิดตัว Gemini 3.8 Flash คู่กับเวอร์ชั่นด้านความปลอดภัยไซเบอร์ ในขณะที่ Meta เปิดตัว Muse Spark 1.3
การเปิดตัวนี้ส่งผลให้เกิดการเปรียบเทียบโดยตรง การทดสอบอิสระโดย Artificial Analysis พบว่าผลลัพธ์แยกกันอย่างชัดเจน Meta เหนือกว่าในด้านงานความรู้เชิงปฏิบัติและการใช้เหตุผลทางวิทยาศาสตร์ ในขณะที่ Google เหนือกว่าในด้านความถูกต้องของข้อมูลและการเขียนโค้ดขั้นปลายทาง
การเปิดตัวสองโมเดล AI แนวหน้าในวันเดียวกัน
Gemini 3.8 Flash ถือเป็นการเปิดตัว Flash ครั้งที่สามของ Google ในรอบหกสัปดาห์ อ่านรายละเอียดเพิ่มเติม โมเดลนี้มีค่าใช้จ่าย USD0.75 ต่อ 1 ล้านโทเคนขาเข้า และ USD3.75 ต่อ 1 ล้านโทเคนขาออก
ติดตามเราได้ที่ X เพื่อรับข่าวสารล่าสุดก่อนใคร
อัตราเริ่มต้นนี้จะใช้ไปจนถึงวันที่ 31 ธันวาคม 2026 หลังจากนั้นราคาจะเพิ่มเป็นสองเท่า คือ USD1.50 และ USD7.50 ต่อ 1 ล้านโทเคน
Google ได้จับคู่โมเดลหลักกับ Gemini 3.8 Flash Cyber ซึ่งเปิดให้เฉพาะกลุ่มผู้ป้องกันระบบไซเบอร์ที่เชื่อถือได้เท่านั้น โมเดลนี้ได้คะแนน 86.2% บน CyberGym ซึ่งเป็นมาตรวัดการค้นหาช่องโหว่
เวอร์ชันไซเบอร์ยังทำคะแนนได้ 47.2% บน CWE-Bench ซึ่งเป็นมาตรวัดการแก้ไขข้อผิดพลาด Google ระบุว่าโมเดลนี้สามารถผลิตแพตช์ที่ถูกต้องสำหรับช่องโหว่ของ Chrome ได้มากกว่าโมเดลเชิงพาณิชย์ขนาดใหญ่อื่นถึง 2.6 เท่า
การเข้าถึงจะต้องผ่านโปรแกรม Fairwind ซึ่งจำกัดให้ใช้สำหรับเจ้าหน้าที่รัฐและผู้ประกอบการโครงสร้างพื้นฐานสำคัญเท่านั้น โดย OpenAI ก็ได้กำหนดขอบเขตแบบเดียวกันนี้กับ Astra โมเดลแรกที่ได้รับการจัดระดับ อยู่ที่เกณฑ์สำคัญด้านความปลอดภัยไซเบอร์ เมื่อวันก่อนหน้านี้
ในขณะเดียวกัน Meta ได้ปล่อย Muse Spark 1.3 ผ่าน Muse Code และ Meta Model API โดยวิศวกรของบริษัทพบว่า การเรียกใช้เครื่องมือในเวอร์ชันใหม่นี้ลดลงราว 20% เมื่อเทียบกับเวอร์ชัน 1.2
Gemini 3.8 Flash vs Muse Spark 1.3: ผลการทดสอบอิสระแยกผลลัพธ์ออกอย่างชัดเจน
Artificial Analysis ได้ทำการทดสอบกับโมเดลเหล่านี้ และผลลัพธ์แสดงให้เห็นว่าแต่ละโมเดลอยู่ในอันดับใด โดย Muse Spark 1.3 ใน max mode ได้คะแนน Elo 1,754 บน GDPval-AA v2 ขณะที่ Gemini 3.8 Flash (high) ได้คืนกลับมา 1,545 คะแนน
Meta ยังเป็นผู้นำในการทดสอบตัวแทนธนาคารของ Sierra Research (52.4% ต่อ 44.9%) และการให้เหตุผลด้านฟิสิกส์ CritPt อีกด้วย ในขณะที่ Gemini 3.8 Flash นำ Terminal-Bench 2.1 ที่ 87.6% บริบทยาว AA-LCR ที่ 81% และความแม่นยำของ AA-Omniscience ที่ 55%
Gemini 3.8 Flash ได้คะแนน GPQA Diamond สูงสุดในบรรดารุ่นที่ถูกทดสอบ โดยอยู่ที่ 95% ทั้งสองรุ่นนี้มีคะแนน Humanity’s Last Exam ต่างกันไม่ถึง 1 คะแนน
สcorer สูงสุดของ Meta ยังไม่เปิดให้ใช้งานในวันนี้ เนื่องจากบริษัทแจ้งว่าจะเปิดใช้ max reasoning เมื่อการทดสอบความปลอดภัยเพิ่มเติมเสร็จสมบูรณ์ ตอนนี้มีเพียงรุ่น xhigh ให้ใช้งานเท่านั้น
เวอร์ชันดังกล่าวได้คะแนน 61 ใน Artificial Analysis Intelligence Index เหนือกว่า Muse Spark 1.2 อยู่ 4 คะแนน อย่างไรก็ตามมันยังตามหลัง Claude Fable 5.1 ที่ 66 และ Claude Opus 5 ที่ 63
ยังมีการเตรียมปล่อยรุ่นเพิ่มเติมอีกหลายรุ่น Elon Musk ได้กล่าวว่า Grok 4.7 จะเปิดตัวเร็วๆ นี้ ซึ่งจะทำให้มีการปล่อยรุ่นล้ำสมัยถึง 4 รุ่นภายในสองสัปดาห์
กดติดตามช่อง YouTube ของเรา เพื่อชมผู้นำและนักข่าวให้ข้อมูลเชิงลึกโดยผู้เชี่ยวชาญ









