กูเกิลเปิดตัวโมเดลเสียงขั้นสูงล่าสุด ดูวิธีการจัดอันดับ

  • โมเดลเสียงใหม่ของ Google ทำคะแนนดัชนีคำพูดของ Artificial Analysis สูงสุดที่ 82.6
  • Gemini 3.8 Live มีค่าใช้จ่าย 0.84 USD ต่อชั่วโมง เป็นโมเดลเสียงที่ถูกที่สุดของดัชนี
  • ผู้ทดสอบยังคงชอบ Gemini 3.1 Flash Live รุ่นเก่าในการทดสอบเสียงแบบ blind test
Promo

Google ได้เปิดตัว Gemini 3.8 Live และ Gemini 3.8 Live Extended Thinking ในวันที่ 15 กันยายน โดยระบุว่านี่คือโมเดลเสียงที่ล้ำหน้าที่สุดของตนจนถึงขณะนี้

โมเดลทั้งสองสามารถสนทนา เหตุผล และจัดการกับงานต่างๆ ได้ แต่โมเดลเหล่านี้ได้รับการจัดอันดับอย่างไรจากนักวิเคราะห์อิสระ? เวอร์ชัน Extended Thinking อยู่อันดับหนึ่งในดัชนี Speech-to-Speech ของ Artificial Analysis ด้วยคะแนน 82.6 นำหน้า GPT-Live-1 และ Grok Voice

ติดตามเราใน X เพื่อรับข่าวสารล่าสุดทันทีที่เกิดขึ้น

มาตรฐานต่างๆ จัดอันดับโมเดล AI สนทนาใหม่ล่าสุดของ Google อย่างไร

ดัชนีของ Artificial Analysis คำนวณจากค่าเฉลี่ยของเหตุผลด้านเสียง การทำงานแบบเอเจนต์ ความชอบใน arena และอัตราความสำเร็จของงาน

ผู้สนับสนุน
ผู้สนับสนุน

Gemini 3.8 Live Extended Thinking เมื่อทดสอบด้วยความพยายามทางเหตุผลสูง ได้เปิดตัวในอันดับหนึ่ง GPT-Live-1 Astra ได้อันดับถัดมาที่ 81.5 ส่วน Grok Voice Think Fast 2.0 High อยู่ที่ 81.3

การจัดอันดับ Gemini 3.8 Live บนดัชนี Speech-to-Speech
การจัดอันดับ Gemini 3.8 Live บนดัชนี Speech-to-Speech ที่มา: Artificial Analysis

Gemini 3.8 Live แบบมาตรฐาน อยู่อันดับห้าด้วยคะแนน 76.0 ทั้งสองเวอร์ชันทำคะแนนได้สูงกว่า Gemini 3.1 Flash Live High ซึ่งได้ 71.5

ส่วนช่องว่างฝั่งเอเจนต์นั้นกว้างขึ้น Extended Thinking ได้ 68.6% บนมาตรฐาน Tau Voice เมื่อเทียบกับรุ่นก่อนที่ทำได้ 37.7%

บนมาตรฐานการเหตุผลด้านเสียง Extended Thinking ทำได้ 97.7% แซง Grok Voice ที่ 97.2% อย่างไรก็ตาม ยังเป็นรอง Qwen Audio 3.0 Realtime Plus ซึ่งได้ 99.2%

ผู้ทดสอบยังคงเลือกใช้ Gemini รุ่นเก่า

ด้านราคาถือว่ามีความแตกต่าง โมเดลมาตรฐานอยู่ที่ 0.84 USD ต่อชั่วโมงของเสียงขาเข้า ซึ่งคิดเป็นประมาณครึ่งหนึ่งของรุ่นก่อนหน้าที่ 1.75 USD และเป็นอัตราที่ถูกที่สุดในดัชนีนี้

Extended Thinking มีค่าใช้จ่ายอยู่ที่ 3.50 USD ต่อชั่วโมง ซึ่งถูกกว่า GPT-Live-1 Sol ที่ 4.47 USD และ Grok Voice Think Fast 2.0 High ที่ 4.80 USD

นอกจากนี้ ระยะเวลาแฝงยังลดลงด้วย โดยค่าเฉลี่ยของเวลาที่ได้ยินเสียงแรก ลดลงเหลือ 1.18 วินาที เมื่อเทียบกับ 2.99 วินาทีของโมเดล Gemini รุ่นเก่า

อย่างไรก็ตาม ผู้ฟังแต่ละคนยังไม่ได้ตัดสินใจแน่นอน Gemini 3.1 Flash Live ยังคงได้รับความนิยมมากที่สุดในหมู่ผู้ทดลองฟัง Arena ของ Speech Agent แบบสุ่ม ด้วย Elo ที่ 1096

ขณะที่ Gemini 3.8 Live ตามมาเป็นอันดับสองที่ 1083 ส่วน Extended Thinking อยู่ที่อันดับ 990 แม้ว่าจะทำงานเสร็จ 89.1% ของงานที่ได้รับมอบหมาย

ปัจจุบัน Voice AI กำลังถูกประเมินอยู่บน 2 มาตรฐานที่ชี้ไปคนละทิศทาง Benchmarks ให้รางวัลกับโมเดลที่มีตรรกะดี ส่วน Preference ให้รางวัลแก่โมเดลที่พูดได้ดีที่สุด ในตอนนี้ Google ยังคงเป็นผู้นำของทั้งสองด้าน แม้จะใช้โมเดลคนละตัวกันก็ตาม

สมัครสมาชิกช่อง YouTube ของเรา เพื่อรับชมผู้นำและนักข่าวแบ่งปันมุมมอง

ข้อจำกัดความรับผิดชอบ

BeInCrypto มุ่งมั่นในการรายงานที่เป็นกลางและโปร่งใส บทความข่าวนี้มีจุดมุ่งหมายเพื่อนำเสนอข้อมูลที่ถูกต้องและทันต่อเหตุการณ์ อย่างไรก็ตาม ขอแนะนำให้ผู้อ่านตรวจสอบข้อเท็จจริงด้วยตนเองและปรึกษาผู้เชี่ยวชาญก่อนตัดสินใจใด ๆ โดยอาศัยเนื้อหานี้ โปรดทราบว่าข้อกำหนดและเงื่อนไข นโยบายความเป็นส่วนตัว และข้อจำกัดความรับผิดชอบของเราได้รับการปรับปรุงแล้ว

ผู้สนับสนุน
ผู้สนับสนุน