Chuyển đến nội dung
reflectionbeam

Đối đầu

Beam vs Qwen 3.8 Max

0:13

Beam thắng 0 trên tổng số 13 benchmark chung

Kết luận

Qwen 3.8 Max dẫn đầu cả 13 benchmark chung, dù khoảng cách ở một số benchmark khá nhỏ (GPQA 92.6 so với 90.5, AA-LCR 80.3 so với 79.3, LongBench 66.3 so với 65.5). Qwen 3.8 Max là mô hình có 2.4 nghìn tỷ tham số, trong đó 95 tỷ tham số hoạt động trên mỗi token, tức quy mô hoạt động lớn gấp khoảng bốn lần Beam; đây là khoảng cách về tính toán mà Reflection nhấn mạnh.

So sánh từng benchmark

BenchmarkBeamQwen 3.8 MaxChênh lệch
DeepSWE v1.144,451,0-6,6
SWE-Bench Pro v165,567,7-2,2
Terminal-Bench v2.180,186,6-6,5
Humanity's Last Exam (no tools)36,243,6-7,4
SciCode49,752,1-2,4
CritPt (AA)16,320,0-3,7
GPQA Diamond90,592,6-2,1
AutomationBench (public)37,039,8-2,8
MCP Atlas78,784,5-5,8
τ³ banking38,055,2-17,2
AA-LCR (long context)79,380,3-1,0
LongBench v265,566,3-0,8
IFBench79,782,8-3,1

Tất cả điểm số đều lấy từ thông báo của Reflection (bản cập nhật October 8, 2026). Điểm số của Qwen 3.8 Max là số liệu Reflection trích dẫn từ Artificial Analysis và DataCurve.

Hai mô hình

BeamQwen 3.8 Max
Nhà phát triểnReflection AIAlibaba (Qwen)
Có trụ sở tạiHoa KỳTrung Quốc
Tham số (tổng / đang hoạt động)501B / 23B2.4T / 95B
Trọng sốApache 2.0, được hứa hẹn ra mắt vào cuối October 2026Qwen3.8-Max License (custom)
Phát hành5 tháng 10, 20263 tháng 8, 2026
Cách truy cậpAPI beta theo danh sách chờ; trọng số sẽ ra mắt sauHugging Face, Alibaba Cloud Model Studio, OpenRouter

Các so sánh khác