Passer au contenu
reflectionbeam

Face à face

Beam vs GLM 5.2

8:5

Beam remporte 8 des 13 benchmarks communs

Verdict

C’est la comparaison choisie par Reflection pour étayer son affirmation phare, et Beam tient la comparaison : il remporte 8 des 13 benchmarks communs, dont SWE-Bench Pro v1, MCP Atlas, AutomationBench et IFBench, tandis que GLM 5.2 devance Beam en raisonnement difficile (AIME, HLE, GPQA, CritPt) et de peu sur Terminal-Bench. Reflection affirme que Beam obtient des scores de raisonnement comparables avec trois à quatre fois moins de calcul d’inférence.

Benchmark par benchmark

BenchmarkBeamGLM 5.2Écart
DeepSWE v1.144,444,0+0,4
SWE-Bench Pro v165,562,1+3,4
Terminal-Bench v2.180,181,0-0,9
AIME 202697,899,2-1,4
Humanity's Last Exam (no tools)36,240,5-4,3
CritPt (AA)16,320,9-4,6
GPQA Diamond90,591,2-0,7
AutomationBench (public)37,026,2+10,8
MCP Atlas78,777,8+0,9
τ³ banking38,037,1+0,9
AA-LCR (long context)79,378,3+1,0
LongBench v265,564,0+1,5
IFBench79,773,3+6,4

Tous les scores proviennent de l’annonce de Reflection (révision du 8 octobre 2026). Les scores de GLM 5.2 sont ceux cités par Reflection, d’après Artificial Analysis et DataCurve.

Les deux modèles

BeamGLM 5.2
DéveloppeurReflection AIZ.ai (Zhipu AI)
Basé àÉtats-UnisChine
Paramètres (total / actifs)501B / 23B753B / 40B
PoidsApache 2.0, promis pour plus tard en octobre 2026MIT
Date de sortie5 octobre 202616 juin 2026
Moyens d’accèsAPI bêta sur liste d’attente ; poids à venirHugging Face, Z.ai API, OpenRouter

Autres comparaisons