Lumaktaw sa nilalaman
reflectionbeam

Direktang paghahambing

Beam vs GLM 5.2

8:5

Nanalo ang Beam sa 8 sa 13 benchmark na pareho nilang iniulat

Pasya

Ito ang paghahambing na pinili ng Reflection para sa pangunahing pahayag nito, at nakakalamang dito ang Beam: panalo ito sa 8 sa 13 magkakaparehong benchmark, kabilang ang SWE-Bench Pro v1, MCP Atlas, AutomationBench at IFBench, habang nangunguna ang GLM 5.2 sa mahihirap na pangangatwiran (AIME, HLE, GPQA, CritPt) at bahagya rin sa Terminal-Bench. Ayon sa Reflection, nakakamit ng Beam ang mga maihahambing na score sa pangangatwiran gamit ang tatlo hanggang apat na beses na mas kaunting compute para sa inference.

Bawat benchmark

BenchmarkBeamGLM 5.2Pagkakaiba
DeepSWE v1.144.444.0+0.4
SWE-Bench Pro v165.562.1+3.4
Terminal-Bench v2.180.181.0-0.9
AIME 202697.899.2-1.4
Humanity's Last Exam (no tools)36.240.5-4.3
CritPt (AA)16.320.9-4.6
GPQA Diamond90.591.2-0.7
AutomationBench (public)37.026.2+10.8
MCP Atlas78.777.8+0.9
τ³ banking38.037.1+0.9
AA-LCR (long context)79.378.3+1.0
LongBench v265.564.0+1.5
IFBench79.773.3+6.4

Lahat ng score ay mula sa anunsyo ng Reflection (rebisyon noong October 8, 2026). Ang mga score para sa GLM 5.2 ay ayon sa mga binanggit ng Reflection mula sa Artificial Analysis at DataCurve.

Ang dalawang modelo

BeamGLM 5.2
DeveloperReflection AIZ.ai (Zhipu AI)
Nakabase saEstados UnidosTsina
Mga parameter (kabuuan / aktibo)501B / 23B753B / 40B
Mga weightApache 2.0, ipinangako para sa bandang huling bahagi ng Oktubre 2026MIT
InilabasOktubre 5, 2026Hunyo 16, 2026
Paano mag-accessAPI beta na nasa waitlist; paparating ang mga weightHugging Face, Z.ai API, OpenRouter

Iba pang paghahambing