เกี่ยวข้องกับหัวข้อนี้สภาเทคโนโลยีแห่งอนาคตและ AI

โมเดล Sonnet ใหม่ของ Anthropic เข้าใกล้ประสิทธิภาพระดับ Opus แต่ใช้โทเคนมากขึ้น

  • Anthropic เปิดตัว Claude Sonnet 5.5 ระบุว่าทำงานเร็วกว่า Sonnet 5 กว่า 30%
  • Artificial Analysis จัดอันดับให้เป็นที่สองในดัชนี Intelligence รองจาก Opus 5.5
  • Sonnet 5.5 ใช้โทเคนเอาต์พุตมากกว่า Opus 5.5 ประมาณ 60% เมื่อทำงานเต็มที่
Promo

Anthropic เปิดตัว Claude Sonnet 5.5 เมื่อวันที่ 28 กันยายน โดยตั้งราคาเท่ากับ Sonnet 5 เดิม ซึ่งทางบริษัทระบุว่ารุ่นใหม่นี้ทำงานได้เร็วขึ้นกว่า 30% และประหยัดต้นทุนได้สูงสุด 30% ต่อหนึ่งงาน

อย่างไรก็ตาม บริษัทประเมินประสิทธิภาพแบบอิสระพบข้อสรุปเรื่องต้นทุนที่ต่างออกไปเมื่อทดลองใช้งานโมเดลจนถึงขีดจำกัด

ติดตามเราบน X เพื่อรับข่าวสารล่าสุดแบบเรียลไทม์

ผู้สนับสนุน
ผู้สนับสนุน

โมเดล 5.5 รุ่นที่สองของ Anthropic เปิดตัวต่อเนื่องหลัง Opus เพียงไม่กี่วัน

Sonnet 5.5 ถือเป็นโมเดลตัวที่สองในตระกูล Claude 5.5 โดย Anthropic ได้เปิดตัว Opus 5.5 เมื่อ วันที่ 22 กันยายน ในวันเดียวกันนั้น OpenAI ก็ได้ออก GPT-6 Sol และ Luna เช่นกัน

โมเดลใหม่นี้ยังคงราคาของ Sonnet 5 ที่ 2 USD ต่อหนึ่งล้าน input tokens และ 10 USD ต่อหนึ่งล้าน output tokens โดย Anthropic รายงานว่ามีคะแนน 70.6% บน Terminal-Bench 4.0 ซึ่งเป็นการทดสอบด้านรหัส Sonnet 5 ทำได้แค่ 10.3% ขณะที่ Opus 5.5 ได้ 66.4%

ทีมงานระบุว่าขณะที่ Opus 5.5 เหมาะกับงานซับซ้อนที่ต้องใช้การตัดสินใจรอบคอบ Sonnet 5.5 จะโดดเด่นกับงานประจำที่ขอบเขตชัดเจน การแก้ Bug และการสร้างเอกสาร สไลด์ หรือสเปรดชีตที่เรียบร้อย

ผู้สนับสนุน
ผู้สนับสนุน

Anthropic กล่าวว่า Sonnet 5.5 ไม่ได้ขยายขีดความสามารถของโมเดล จึงให้ความสำคัญกับการประเมินความเสี่ยง เช่น การทำให้ผู้ใช้งานเข้าใจผิด หรืออาจถูกนำไปใช้ในทางที่มีความเสี่ยงสูง

Sonnet 5.5 ก็มาพร้อมกับมาตรการความปลอดภัยทางไซเบอร์ และเครื่องมือป้องกันการนำเหตุผลหรือเหตุผลประกอบการตัดสินใจของโมเดลไปฝึกสอนกับระบบคู่แข่ง โดย Claude Haiku 5.5 เตรียมเปิดตัวในไม่กี่สัปดาห์ข้างหน้า

ขณะเดียวกัน OpenAI ระงับการเปิดตัวโมเดลถัดไป GPT-6.1 Astra ด้วยเหตุผลด้านความปลอดภัย CNBC ยืนยันเมื่อวันจันทร์ว่ารุ่นดังกล่าวยังไม่ผ่าน มาตรฐานของบริษัท

Artificial Analysis เผยว่าต้นทุน Token สูงขึ้นเมื่อใช้งานสูงสุด

บริษัทประเมินประสิทธิภาพ Artificial Analysis ซึ่งจัดอันดับ Grok 4.7 ไว้อันดับสี่ ได้มอบคะแนน 56 ให้กับ Sonnet 5.5 ใน Intelligence Index ส่งผลให้รุ่นนี้ได้อันดับสองรองจาก Opus 5.5 ที่มีคะแนนสูงกว่า 2 คะแนนในระดับการใช้งานสูงสุด

บริษัทบันทึกคะแนน 64% สำหรับ Sonnet 5.5 บน Terminal-Bench 4.0 เทียบกับ 60% ของ Opus 5.5 และ GPT-6 Astra นอกจากนี้ ในการทดสอบด้านการทำงานกับความรู้ เช่น GDPval-AA บริษัทพบว่า Sonnet 5.5 ทำได้ใกล้เคียงกับ Opus 5.5

บริษัทกล่าวว่า Sonnet 5.5 ใช้จำนวน tokens มากกว่ามากเพื่อให้ได้ผลลัพธ์เหล่านี้

ที่ความพยายามสูงสุดซึ่งทำให้ประสิทธิภาพใกล้เคียงกับของ Opus 5.5 Claude Sonnet 5.5 ใช้ Output Tokens ประมาณ 193,000 ต่อหนึ่ง Intelligence Index Task โพสต์ ระบุไว้

ปริมาณนี้สูงกว่า Opus 5.5 และ Sonnet 5 ประมาณ 60% เมื่อใช้ความพยายามสูงสุด และยังมากกว่า 7 เท่าของจำนวนสูงสุดของ GPT-6 Astra ด้วยเช่นกัน

อย่างไรก็ตาม ลูกค้ากลุ่ม early-access ที่ Anthropic อ้างอิงรายงานแนวโน้มตรงข้ามกับ Sonnet 5 โดยเกิดขึ้นกับงานคนละประเภท Balyasny Asset Management เห็นการใช้ tokens ต่ำกว่ามากในการทำงานด้านการเงิน

ในชุดงานการเงินส่วนตัวของเราจำนวน 2,441 งาน ครอบคลุม Q&A, การดึงข้อมูล, วิเคราะห์ และการพยากรณ์ Claude Sonnet 5.5 ทำคะแนนนำหน้า Sonnet 5 และใช้ประมาณ 121,000 tokens ตอบแต่ละข้อ ขณะที่ Sonnet 5 ใช้ 497,000 Joe Poirier Senior AI Engineer แห่ง Balyasny Asset Management กล่าว

Artificial Analysis ได้ทดสอบรุ่นก่อนปล่อยที่มีบั๊กโครงสร้าง output ซึ่ง Anthropic ได้แก้ไขแล้ว โดยบริษัทมีแผนจะประเมินซ้ำในเร็วๆ นี้

สมัครรับข้อมูลช่อง YouTube ของเรา ติดตามผู้นำและผู้สื่อข่าวที่มอบข้อมูลเชิงลึกอย่างเชี่ยวชาญ

ข้อจำกัดความรับผิดชอบ

BeInCrypto มุ่งมั่นในการรายงานที่เป็นกลางและโปร่งใส บทความข่าวนี้มีจุดมุ่งหมายเพื่อนำเสนอข้อมูลที่ถูกต้องและทันต่อเหตุการณ์ อย่างไรก็ตาม ขอแนะนำให้ผู้อ่านตรวจสอบข้อเท็จจริงด้วยตนเองและปรึกษาผู้เชี่ยวชาญก่อนตัดสินใจใด ๆ โดยอาศัยเนื้อหานี้ โปรดทราบว่าข้อกำหนดและเงื่อนไข นโยบายความเป็นส่วนตัว และข้อจำกัดความรับผิดชอบของเราได้รับการปรับปรุงแล้ว

ผู้สนับสนุน
ผู้สนับสนุน