Anthropic เปิดตัว Claude Sonnet 5.5 เมื่อวันที่ 28 กันยายน โดยตั้งราคาเท่ากับ Sonnet 5 เดิม ซึ่งทางบริษัทระบุว่ารุ่นใหม่นี้ทำงานได้เร็วขึ้นกว่า 30% และประหยัดต้นทุนได้สูงสุด 30% ต่อหนึ่งงาน
อย่างไรก็ตาม บริษัทประเมินประสิทธิภาพแบบอิสระพบข้อสรุปเรื่องต้นทุนที่ต่างออกไปเมื่อทดลองใช้งานโมเดลจนถึงขีดจำกัด
ติดตามเราบน X เพื่อรับข่าวสารล่าสุดแบบเรียลไทม์
โมเดล 5.5 รุ่นที่สองของ Anthropic เปิดตัวต่อเนื่องหลัง Opus เพียงไม่กี่วัน
Sonnet 5.5 ถือเป็นโมเดลตัวที่สองในตระกูล Claude 5.5 โดย Anthropic ได้เปิดตัว Opus 5.5 เมื่อ วันที่ 22 กันยายน ในวันเดียวกันนั้น OpenAI ก็ได้ออก GPT-6 Sol และ Luna เช่นกัน
โมเดลใหม่นี้ยังคงราคาของ Sonnet 5 ที่ 2 USD ต่อหนึ่งล้าน input tokens และ 10 USD ต่อหนึ่งล้าน output tokens โดย Anthropic รายงานว่ามีคะแนน 70.6% บน Terminal-Bench 4.0 ซึ่งเป็นการทดสอบด้านรหัส Sonnet 5 ทำได้แค่ 10.3% ขณะที่ Opus 5.5 ได้ 66.4%
ทีมงานระบุว่าขณะที่ Opus 5.5 เหมาะกับงานซับซ้อนที่ต้องใช้การตัดสินใจรอบคอบ Sonnet 5.5 จะโดดเด่นกับงานประจำที่ขอบเขตชัดเจน การแก้ Bug และการสร้างเอกสาร สไลด์ หรือสเปรดชีตที่เรียบร้อย
Anthropic กล่าวว่า Sonnet 5.5 ไม่ได้ขยายขีดความสามารถของโมเดล จึงให้ความสำคัญกับการประเมินความเสี่ยง เช่น การทำให้ผู้ใช้งานเข้าใจผิด หรืออาจถูกนำไปใช้ในทางที่มีความเสี่ยงสูง
Sonnet 5.5 ก็มาพร้อมกับมาตรการความปลอดภัยทางไซเบอร์ และเครื่องมือป้องกันการนำเหตุผลหรือเหตุผลประกอบการตัดสินใจของโมเดลไปฝึกสอนกับระบบคู่แข่ง โดย Claude Haiku 5.5 เตรียมเปิดตัวในไม่กี่สัปดาห์ข้างหน้า
ขณะเดียวกัน OpenAI ระงับการเปิดตัวโมเดลถัดไป GPT-6.1 Astra ด้วยเหตุผลด้านความปลอดภัย CNBC ยืนยันเมื่อวันจันทร์ว่ารุ่นดังกล่าวยังไม่ผ่าน มาตรฐานของบริษัท
Artificial Analysis เผยว่าต้นทุน Token สูงขึ้นเมื่อใช้งานสูงสุด
บริษัทประเมินประสิทธิภาพ Artificial Analysis ซึ่งจัดอันดับ Grok 4.7 ไว้อันดับสี่ ได้มอบคะแนน 56 ให้กับ Sonnet 5.5 ใน Intelligence Index ส่งผลให้รุ่นนี้ได้อันดับสองรองจาก Opus 5.5 ที่มีคะแนนสูงกว่า 2 คะแนนในระดับการใช้งานสูงสุด
บริษัทบันทึกคะแนน 64% สำหรับ Sonnet 5.5 บน Terminal-Bench 4.0 เทียบกับ 60% ของ Opus 5.5 และ GPT-6 Astra นอกจากนี้ ในการทดสอบด้านการทำงานกับความรู้ เช่น GDPval-AA บริษัทพบว่า Sonnet 5.5 ทำได้ใกล้เคียงกับ Opus 5.5
บริษัทกล่าวว่า Sonnet 5.5 ใช้จำนวน tokens มากกว่ามากเพื่อให้ได้ผลลัพธ์เหล่านี้
ที่ความพยายามสูงสุดซึ่งทำให้ประสิทธิภาพใกล้เคียงกับของ Opus 5.5 Claude Sonnet 5.5 ใช้ Output Tokens ประมาณ 193,000 ต่อหนึ่ง Intelligence Index Task โพสต์ ระบุไว้
ปริมาณนี้สูงกว่า Opus 5.5 และ Sonnet 5 ประมาณ 60% เมื่อใช้ความพยายามสูงสุด และยังมากกว่า 7 เท่าของจำนวนสูงสุดของ GPT-6 Astra ด้วยเช่นกัน
อย่างไรก็ตาม ลูกค้ากลุ่ม early-access ที่ Anthropic อ้างอิงรายงานแนวโน้มตรงข้ามกับ Sonnet 5 โดยเกิดขึ้นกับงานคนละประเภท Balyasny Asset Management เห็นการใช้ tokens ต่ำกว่ามากในการทำงานด้านการเงิน
ในชุดงานการเงินส่วนตัวของเราจำนวน 2,441 งาน ครอบคลุม Q&A, การดึงข้อมูล, วิเคราะห์ และการพยากรณ์ Claude Sonnet 5.5 ทำคะแนนนำหน้า Sonnet 5 และใช้ประมาณ 121,000 tokens ตอบแต่ละข้อ ขณะที่ Sonnet 5 ใช้ 497,000 Joe Poirier Senior AI Engineer แห่ง Balyasny Asset Management กล่าว
Artificial Analysis ได้ทดสอบรุ่นก่อนปล่อยที่มีบั๊กโครงสร้าง output ซึ่ง Anthropic ได้แก้ไขแล้ว โดยบริษัทมีแผนจะประเมินซ้ำในเร็วๆ นี้
สมัครรับข้อมูลช่อง YouTube ของเรา ติดตามผู้นำและผู้สื่อข่าวที่มอบข้อมูลเชิงลึกอย่างเชี่ยวชาญ









