Chuyển đến nội dung
reflectionbeam

Đối đầu

Beam vs GLM 5.2

8:5

Beam thắng 8 trên tổng số 13 benchmark chung

Kết luận

Đây là phép so sánh Reflection chọn làm luận điểm chính, và Beam thể hiện rất tốt: mẫu này thắng 8 trong 13 benchmark chung, bao gồm SWE-Bench Pro v1, MCP Atlas, AutomationBench và IFBench, trong khi GLM 5.2 dẫn trước về suy luận khó (AIME, HLE, GPQA, CritPt) và nhỉnh hơn đôi chút trên Terminal-Bench. Reflection cho biết Beam đạt điểm suy luận tương đương với lượng tính toán suy luận ít hơn từ ba đến bốn lần.

So sánh từng benchmark

BenchmarkBeamGLM 5.2Chênh lệch
DeepSWE v1.144,444,0+0,4
SWE-Bench Pro v165,562,1+3,4
Terminal-Bench v2.180,181,0-0,9
AIME 202697,899,2-1,4
Humanity's Last Exam (no tools)36,240,5-4,3
CritPt (AA)16,320,9-4,6
GPQA Diamond90,591,2-0,7
AutomationBench (public)37,026,2+10,8
MCP Atlas78,777,8+0,9
τ³ banking38,037,1+0,9
AA-LCR (long context)79,378,3+1,0
LongBench v265,564,0+1,5
IFBench79,773,3+6,4

Tất cả điểm số đều lấy từ thông báo của Reflection (bản cập nhật October 8, 2026). Điểm số của GLM 5.2 là số liệu Reflection trích dẫn từ Artificial Analysis và DataCurve.

Hai mô hình

BeamGLM 5.2
Nhà phát triểnReflection AIZ.ai (Zhipu AI)
Có trụ sở tạiHoa KỳTrung Quốc
Tham số (tổng / đang hoạt động)501B / 23B753B / 40B
Trọng sốApache 2.0, được hứa hẹn ra mắt vào cuối October 2026MIT
Phát hành5 tháng 10, 202616 tháng 6, 2026
Cách truy cậpAPI beta theo danh sách chờ; trọng số sẽ ra mắt sauHugging Face, Z.ai API, OpenRouter

Các so sánh khác