ข้ามไปยังเนื้อหา
reflectionbeam

เปรียบเทียบแบบตัวต่อตัว

Beam vs Qwen 3.8 Max

0:13

Beam ชนะ 0 จาก 13 เบนช์มาร์กที่ใช้ร่วมกัน

บทสรุป

Qwen 3.8 Max นำในเบนช์มาร์กร่วมทั้ง 13 รายการ แม้ช่องว่างบางรายการจะน้อย (GPQA 92.6 เทียบกับ 90.5, AA-LCR 80.3 เทียบกับ 79.3, LongBench 66.3 เทียบกับ 65.5) Qwen 3.8 Max เป็นโมเดลที่มีพารามิเตอร์ 2.4 ล้านล้านตัว โดยมีพารามิเตอร์ที่ทำงานอยู่ 95 พันล้านตัวต่อโทเค็น หรือราวสี่เท่าของ Beam ซึ่งเป็นช่องว่างด้านคอมพิวต์ที่ Reflection ชี้ให้เห็น

แยกตามเบนช์มาร์ก

BenchmarkBeamQwen 3.8 Maxส่วนต่าง
DeepSWE v1.144.451.0-6.6
SWE-Bench Pro v165.567.7-2.2
Terminal-Bench v2.180.186.6-6.5
Humanity's Last Exam (no tools)36.243.6-7.4
SciCode49.752.1-2.4
CritPt (AA)16.320.0-3.7
GPQA Diamond90.592.6-2.1
AutomationBench (public)37.039.8-2.8
MCP Atlas78.784.5-5.8
τ³ banking38.055.2-17.2
AA-LCR (long context)79.380.3-1.0
LongBench v265.566.3-0.8
IFBench79.782.8-3.1

คะแนนทั้งหมดมาจากประกาศของ Reflection (ฉบับปรับปรุงวันที่ 8 ตุลาคม 2026) คะแนนของ Qwen 3.8 Max อ้างอิงตามที่ Reflection ระบุจาก Artificial Analysis และ DataCurve

โมเดลทั้งสอง

BeamQwen 3.8 Max
ผู้พัฒนาReflection AIAlibaba (Qwen)
ตั้งอยู่ที่สหรัฐอเมริกาจีน
พารามิเตอร์ (ทั้งหมด / ที่ใช้งาน)501B / 23B2.4T / 95B
น้ำหนักโมเดลApache 2.0 โดยสัญญาว่าจะเปิดให้ใช้ภายหลังในเดือนตุลาคม 2026Qwen3.8-Max License (custom)
เปิดตัว5 ตุลาคม 25693 สิงหาคม 2569
วิธีเข้าถึงAPI เบตาที่ต้องเข้าคิวรอ; จะเปิดให้ใช้น้ำหนักโมเดลเร็ว ๆ นี้Hugging Face, Alibaba Cloud Model Studio, OpenRouter

การเปรียบเทียบอื่น ๆ

แหล่งที่มา