เกี่ยวข้องกับหัวข้อนี้สภาเทคโนโลยีแห่งอนาคตและ AI

อีลอน มัสก์เผย Grok 4.7 จะแรงกว่าโมเดลทั้งหมด จริงหรือไม่?

  • Grok 4.7 ได้คะแนน 46 ในดัชนีความฉลาดของ Artificial Analysis ติดอันดับสี่
  • โมเดลแซงหน้า GPT-5.6 Sol ด้านโค้ด แต่ประสิทธิภาพแลกกับต้นทุนสูง
  • มัสก์เผย Grok 4.8 จะฝึกเสร็จ และ Grok 5 จะเข้าใกล้ AGI
Promo

SpaceXAI เปิดตัว Grok 4.7 และคะแนนอิสระจัดให้อยู่อันดับสี่ในหมู่ห้องปฏิบัติการ AI ขั้นแนวหน้า

Artificial Analysis ซึ่งเป็นบริษัทจัดอันดับอิสระ ได้ให้คะแนนโมเดลนี้ที่ 46 ใน Intelligence Index ซึ่งสูงกว่า Grok 4.6 อยู่ 2 คะแนน Claude Fable 5.1, GPT-6 Astra และ Claude Opus 5 ต่างก็อยู่อันดับสูงกว่า

Grok 4.7 ดัน SpaceXAI ขึ้นสู่อันดับท็อปโฟร์ห้องปฏิบัติการ AI

Elon Musk เคยกล่าวก่อนเปิดตัวว่า โมเดลนี้จะทำงานบนพื้นฐานของพารามิเตอร์ 2.1 ล้านล้านและจะเหนือกว่าโมเดลอื่นทั้งหมดในปัจจุบัน นอกจากนี้เขายังเสริมด้วยว่าโมเดลนี้ได้รับการฝึกด้วยข้อมูลของบริษัท SpaceX ด้วย

ติดตามเราใน X เพื่ออัปเดตข่าวสารล่าสุดแบบทันเหตุการณ์

ผู้สนับสนุน
ผู้สนับสนุน

แต่ Grok 4.7 ทำผลงานได้จริงหรือไม่? บน AA-Briefcase ซึ่งเป็นมาตรฐานสำหรับงานจริงในวิชาชีพโดย Artificial Analysis, Grok 4.7 ได้ 1657 Elo เป็นการขยับเพิ่มขึ้น 111 คะแนนจาก Grok 4.6 และทำให้ระดับของโมเดลนี้ใกล้กับ Claude Opus 5

ใน GDPval-AA โมเดลนี้ได้ถึง 1695 Elo ซึ่งเหนือกว่ารุ่นก่อนอยู่ 90 คะแนน และผลลัพธ์เรื่องโค้ดดิ้งก็เคลื่อนไปในทิศทางเดียวกัน

เมื่อใช้งานร่วมกับ Grok Build ซึ่งเป็นเอเจนต์โค้ดดิ้งของตัวเอง Grok 4.7 ได้ 56 คะแนนใน Coding Agent Index ซึ่งสูงกว่า Grok 4.6 ถึงเก้าคะแนน

โมเดลนี้แซงหน้า GPT-5.6 Sol และขณะนี้ตามหลังเพียง Claude Fable 5.1 ของ Anthropic, GPT-6 Astra และ Opus 5 เท่านั้น

Grok 4.7 ได้ 46 คะแนนใน Artificial Analysis Intelligence Index ดัน SpaceXAI ขึ้นเป็นหนึ่งในท็อป 4 ห้องปฏิบัติการ AI ผลงานใน Coding Agent Index ดีขึ้น แซงหน้า GPT-5.6 Sol, ตามเนื้อหาของโพสต์

ประสิทธิภาพของ Grok 4.7
ประสิทธิภาพของ Grok 4.7 ที่มา: X/Artificial Analysis

ในส่วนอื่น ๆ แบบจำลองแทบไม่เปลี่ยนแปลง โดยมันเพิ่มขึ้น 4.5 จุดเปอร์เซ็นต์ใน Terminal-Bench 4.0 และ 3 จุดใน GDP.pdf ขณะที่คะแนนลดลงในแบบทดสอบ AA-LCR และ AutomationBench-AA อย่างไรก็ตาม Grok 4.5 เคยทำคะแนนสูงสุดใน AutomationBench เมื่อเดือนกรกฎาคม ซึ่งสนับสนุนคำกล่าวอ้างของ Musk ว่ามันสามารถเทียบเคียง Claude Opus ได้

ประสิทธิภาพที่เพิ่มขึ้นมากับค่าใช้จ่าย Token

อัตราค่าบริการยังคงเดิม โดย Grok 4.7 ยังคงมีค่าใช้จ่าย 2 USD ต่อ input token หนึ่งล้าน token และ 6 USD ต่อ output token หนึ่งล้าน token ในขณะที่ cache ที่เจอจะได้รับส่วนลดเหลือเพียง 0.50 USD และหน้าต่าง context ขนาด 500,000 token ยังคงเหมือนกับ Grok 4.6

แต่แบบจำลองใหม่นี้กลับต้องทำงานเพิ่มมากขึ้นในทุกคำตอบ Artificial Analysis พบว่ามีการสร้าง output token เฉลี่ยประมาณ 81,000 token ต่อ Index task เมื่อเทียบกับ Grok 4.6 ที่ 36,000 token และ GPT-6 Astra ที่ 27,000 token ส่งผลให้ถึงแม้จะคิดราคาเท่าเดิมตามจำนวน token แต่สุดท้ายแล้วค่าใช้จ่ายต่อหนึ่ง task ก็สูงขึ้นอย่างชัดเจน

การใช้ token จำนวนมากนี้ส่งผลกระทบต่อฝ่ายที่ได้รายงานการขาดทุน 1.26 พันล้าน USD เอาไว้แล้ว ขณะเดียวกัน Musk ก็ได้กล่าวเมื่อวันที่ 14 กันยายนว่า Grok 4.8 จะเสร็จสิ้นการฝึกภายในหนึ่งสัปดาห์

นอกจากนี้ เขายังคาดหวังว่า Grok 5จะเป็นแบบจำลองที่บรรลุ artificial general intelligence ซึ่งการอัปเดตครั้งต่อไปนี้จะเป็นบททดสอบว่า SpaceXAI จะสามารถไต่อันดับได้โดยไม่ต้องสิ้นเปลืองระบบคอมพิวเตอร์มากขึ้นหรือไม่

กดติดตามช่อง YouTube ของเรา เพื่อรับชมผู้นำและนักข่าวแบ่งปันข้อมูลเชิงลึกจากผู้เชี่ยวชาญ

https://youtu.be/IcgIaeIE7LI

ข้อจำกัดความรับผิดชอบ

BeInCrypto มุ่งมั่นในการรายงานที่เป็นกลางและโปร่งใส บทความข่าวนี้มีจุดมุ่งหมายเพื่อนำเสนอข้อมูลที่ถูกต้องและทันต่อเหตุการณ์ อย่างไรก็ตาม ขอแนะนำให้ผู้อ่านตรวจสอบข้อเท็จจริงด้วยตนเองและปรึกษาผู้เชี่ยวชาญก่อนตัดสินใจใด ๆ โดยอาศัยเนื้อหานี้ โปรดทราบว่าข้อกำหนดและเงื่อนไข นโยบายความเป็นส่วนตัว และข้อจำกัดความรับผิดชอบของเราได้รับการปรับปรุงแล้ว

ผู้สนับสนุน
ผู้สนับสนุน