Перейти к содержимому
reflectionbeam

Лобовое сравнение

Beam vs GLM 5.2

8:5

Beam лидирует в 8 из 13 общих бенчмарков

Итог

Именно это сравнение Reflection выбрала для главного заявления, и Beam не подводит: он побеждает в 8 из 13 общих бенчмарков, включая SWE-Bench Pro v1, MCP Atlas, AutomationBench и IFBench, тогда как GLM 5.2 опережает его в сложных задачах на рассуждение (AIME, HLE, GPQA, CritPt) и немного — в Terminal-Bench. По словам Reflection, Beam достигает сопоставимых результатов в задачах на рассуждение, используя в три-четыре раза меньше вычислительных ресурсов для инференса.

Сравнение по каждому бенчмарку

БенчмаркBeamGLM 5.2Разница
DeepSWE v1.144,444,0+0,4
SWE-Bench Pro v165,562,1+3,4
Terminal-Bench v2.180,181,0-0,9
AIME 202697,899,2-1,4
Humanity's Last Exam (no tools)36,240,5-4,3
CritPt (AA)16,320,9-4,6
GPQA Diamond90,591,2-0,7
AutomationBench (public)37,026,2+10,8
MCP Atlas78,777,8+0,9
τ³ banking38,037,1+0,9
AA-LCR (long context)79,378,3+1,0
LongBench v265,564,0+1,5
IFBench79,773,3+6,4

Все результаты взяты из анонса Reflection (редакция от 8 октября 2026 года). Результаты для GLM 5.2 приведены по данным Reflection, со ссылкой на Artificial Analysis и DataCurve.

Две модели

BeamGLM 5.2
РазработчикReflection AIZ.ai (Zhipu AI)
Базируется вСШАКитай
Параметры (всего / активных)501B / 23B753B / 40B
ВесаApache 2.0, обещана на более поздний срок в октябре 2026 годаMIT
Дата выпуска5 октября 2026 г.16 июня 2026 г.
Как получить доступБета-API с листом ожидания; веса появятся позжеHugging Face, Z.ai API, OpenRouter

Другие сравнения