Alibaba เปิดตัว Qwen3.8-Max ในวันจันทร์พร้อมกับการเผยแพร่คะแนน benchmark ครั้งแรก โดยโมเดลนี้อยู่อันดับที่สี่บนกระดานผู้นำ Arena’s Frontend Code ซึ่งเหนือกว่ามีแค่ Claude Opus 5 และ Kimi K3 ของ Moonshot ที่ได้คะแนนมากกว่าในการทดสอบนี้
โมเดลที่มีพารามิเตอร์ 2.4 ล้านล้านตัวนี้ออกจากพรีวิวเดือนกรกฎาคมด้วยจำนวนพารามิเตอร์ที่ใช้งานจริง 95 พันล้านตัว มีหน้าต่างบริบท 1 ล้านโทเคน และเปิดเผยราคาผ่าน API สาธารณะ
Qwen3.8-Max ตามหลังแค่ Claude และ Kimi ในการทดสอบการเขียนโค้ด
Qwen3.8-Max ได้รับคะแนน 1,668 บนกระดาน Arena’s leaderboard ซึ่งตามหลัง Claude Opus 5 (High) เพียงหนึ่งคะแนน Claude Opus 5 (Max) นำอันดับด้วย 1,705 คะแนน ส่วน Kimi K3 (Max) ครอง อันดับสองที่ 1,676 โมเดลนี้ยังได้อันดับสองในหมวด Consumer Product ของ Arena อีกด้วย
ติดตามเราใน X เพื่ออัปเดตข่าวล่าสุดทันทีเมื่อเกิดขึ้น
ข้อมูลที่ Alibaba เปิดเผยอ้างว่าชนะ Claude Opus 4.8, Fable 5 และ GPT-5.6 ใน benchmark ด้าน agentic และ multimodal โดยข้อมูลแสดงค่า 86.6 บน TerminalBench-2.1, 93.0 ที่ PaperBench และ 86.1 บน OSWorld-Verified
อย่างไรก็ตาม Fable 5 ของ Anthropic ยังคงนำห่าง ในด้านวิศวกรรมซอฟต์แวร์หลัก โดยมีคะแนน 80.0 ใน SWE-Pro เทียบกับ 67.7 ของ Qwen และ 88.8 ที่ FrontierSWE เทียบกับ 73.5
โมเดล Open Max ตัวแรกเปิดตัวพร้อมหุ้น Alibaba พุ่งขึ้น
การเปิดตัวครั้งนี้ถือเป็นครั้งแรกที่ Alibaba จะเปิดซอร์สเวทของโมเดลตระกูล Qwen-Max
สัปดาห์หน้าเวทแบบเปิดของ Qwen3.8-Max จะถูกปล่อยออกมา และ Qwen3.8-27B ก็จะเปิดเวทให้ทุกคนได้ใช้งานเช่นกัน! ทีมงานกล่าว
น้ำหนักจะถูกนำไปใช้กับ Hugging Face และ ModelScope ในขณะเดียวกัน ราคาของ API เริ่มต้นที่ USD2 ต่อโทเค็นอินพุตหนึ่งล้าน และ USD6 ต่อโทเค็นเอาต์พุตหนึ่งล้าน
นักลงทุนต่างตอบสนองอย่างรวดเร็วต่อการเปิดตัวครั้งนี้ และราคาหุ้นของ Alibaba เพิ่มขึ้น 6.15% ไปอยู่ที่ 124.20 ดอลลาร์ฮ่องกงในช่วงพักกลางวันของฮ่องกง จากราคาปิดก่อนหน้าที่ 117 ดอลลาร์ฮ่องกง
ราคาหุ้นขยายตัวจากการเพิ่มขึ้น 4.65% เมื่อวันศุกร์ ซึ่งนักวิเคราะห์เชื่อมโยงกับรายงาน ข้อตกลงชิพ Moonshot ซึ่งการประเมินจากอิสระอาจช่วยให้เห็นภาพที่ชัดเจนขึ้นเมื่อมีการใช้น้ำหนักในสัปดาห์หน้า
สมัครรับข้อมูล YouTube ของเรา เพื่อรับชมผู้นำและนักข่าวให้ข้อมูลวิเคราะห์เชิงลึก









