Lewati ke konten
reflectionbeam

Adu langsung

Beam vs GLM 5.2

8:5

Beam unggul pada 8 dari 13 benchmark yang sama

Kesimpulan

Ini adalah perbandingan yang dipilih Reflection untuk klaim utamanya, dan Beam mampu bersaing: Beam unggul pada 8 dari 13 benchmark yang sama, termasuk SWE-Bench Pro v1, MCP Atlas, AutomationBench, dan IFBench, sedangkan GLM 5.2 unggul dalam penalaran sulit (AIME, HLE, GPQA, CritPt) dan sedikit lebih unggul pada Terminal-Bench. Reflection menyatakan Beam mencapai skor penalaran yang sebanding dengan komputasi inferensi tiga hingga empat kali lebih sedikit.

Perbandingan per benchmark

BenchmarkBeamGLM 5.2Selisih
DeepSWE v1.144,444,0+0,4
SWE-Bench Pro v165,562,1+3,4
Terminal-Bench v2.180,181,0-0,9
AIME 202697,899,2-1,4
Humanity's Last Exam (no tools)36,240,5-4,3
CritPt (AA)16,320,9-4,6
GPQA Diamond90,591,2-0,7
AutomationBench (public)37,026,2+10,8
MCP Atlas78,777,8+0,9
τ³ banking38,037,1+0,9
AA-LCR (long context)79,378,3+1,0
LongBench v265,564,0+1,5
IFBench79,773,3+6,4

Semua skor berasal dari pengumuman Reflection (revisi 8 Oktober 2026). Skor untuk GLM 5.2 adalah sebagaimana dikutip Reflection dari Artificial Analysis dan DataCurve.

Kedua model

BeamGLM 5.2
DeveloperReflection AIZ.ai (Zhipu AI)
Berbasis diAmerika SerikatChina
Parameter (total / aktif)501B / 23B753B / 40B
BobotApache 2.0, dijanjikan hadir nanti pada Oktober 2026MIT
Dirilis5 Oktober 202616 Juni 2026
Cara mengaksesAPI beta masuk daftar tunggu; bobot segera hadirHugging Face, Z.ai API, OpenRouter

Perbandingan lainnya