Google ได้เปิดตัว Gemini 3.8 Live และ Gemini 3.8 Live Extended Thinking ในวันที่ 15 กันยายน โดยระบุว่านี่คือโมเดลเสียงที่ล้ำหน้าที่สุดของตนจนถึงขณะนี้
โมเดลทั้งสองสามารถสนทนา เหตุผล และจัดการกับงานต่างๆ ได้ แต่โมเดลเหล่านี้ได้รับการจัดอันดับอย่างไรจากนักวิเคราะห์อิสระ? เวอร์ชัน Extended Thinking อยู่อันดับหนึ่งในดัชนี Speech-to-Speech ของ Artificial Analysis ด้วยคะแนน 82.6 นำหน้า GPT-Live-1 และ Grok Voice
ติดตามเราใน X เพื่อรับข่าวสารล่าสุดทันทีที่เกิดขึ้น
มาตรฐานต่างๆ จัดอันดับโมเดล AI สนทนาใหม่ล่าสุดของ Google อย่างไร
ดัชนีของ Artificial Analysis คำนวณจากค่าเฉลี่ยของเหตุผลด้านเสียง การทำงานแบบเอเจนต์ ความชอบใน arena และอัตราความสำเร็จของงาน
Gemini 3.8 Live Extended Thinking เมื่อทดสอบด้วยความพยายามทางเหตุผลสูง ได้เปิดตัวในอันดับหนึ่ง GPT-Live-1 Astra ได้อันดับถัดมาที่ 81.5 ส่วน Grok Voice Think Fast 2.0 High อยู่ที่ 81.3
Gemini 3.8 Live แบบมาตรฐาน อยู่อันดับห้าด้วยคะแนน 76.0 ทั้งสองเวอร์ชันทำคะแนนได้สูงกว่า Gemini 3.1 Flash Live High ซึ่งได้ 71.5
ส่วนช่องว่างฝั่งเอเจนต์นั้นกว้างขึ้น Extended Thinking ได้ 68.6% บนมาตรฐาน Tau Voice เมื่อเทียบกับรุ่นก่อนที่ทำได้ 37.7%
บนมาตรฐานการเหตุผลด้านเสียง Extended Thinking ทำได้ 97.7% แซง Grok Voice ที่ 97.2% อย่างไรก็ตาม ยังเป็นรอง Qwen Audio 3.0 Realtime Plus ซึ่งได้ 99.2%
ผู้ทดสอบยังคงเลือกใช้ Gemini รุ่นเก่า
ด้านราคาถือว่ามีความแตกต่าง โมเดลมาตรฐานอยู่ที่ 0.84 USD ต่อชั่วโมงของเสียงขาเข้า ซึ่งคิดเป็นประมาณครึ่งหนึ่งของรุ่นก่อนหน้าที่ 1.75 USD และเป็นอัตราที่ถูกที่สุดในดัชนีนี้
Extended Thinking มีค่าใช้จ่ายอยู่ที่ 3.50 USD ต่อชั่วโมง ซึ่งถูกกว่า GPT-Live-1 Sol ที่ 4.47 USD และ Grok Voice Think Fast 2.0 High ที่ 4.80 USD
นอกจากนี้ ระยะเวลาแฝงยังลดลงด้วย โดยค่าเฉลี่ยของเวลาที่ได้ยินเสียงแรก ลดลงเหลือ 1.18 วินาที เมื่อเทียบกับ 2.99 วินาทีของโมเดล Gemini รุ่นเก่า
อย่างไรก็ตาม ผู้ฟังแต่ละคนยังไม่ได้ตัดสินใจแน่นอน Gemini 3.1 Flash Live ยังคงได้รับความนิยมมากที่สุดในหมู่ผู้ทดลองฟัง Arena ของ Speech Agent แบบสุ่ม ด้วย Elo ที่ 1096
ขณะที่ Gemini 3.8 Live ตามมาเป็นอันดับสองที่ 1083 ส่วน Extended Thinking อยู่ที่อันดับ 990 แม้ว่าจะทำงานเสร็จ 89.1% ของงานที่ได้รับมอบหมาย
ปัจจุบัน Voice AI กำลังถูกประเมินอยู่บน 2 มาตรฐานที่ชี้ไปคนละทิศทาง Benchmarks ให้รางวัลกับโมเดลที่มีตรรกะดี ส่วน Preference ให้รางวัลแก่โมเดลที่พูดได้ดีที่สุด ในตอนนี้ Google ยังคงเป็นผู้นำของทั้งสองด้าน แม้จะใช้โมเดลคนละตัวกันก็ตาม
สมัครสมาชิกช่อง YouTube ของเรา เพื่อรับชมผู้นำและนักข่าวแบ่งปันมุมมอง









