Перейти к содержимому
reflectionbeam

Лобовое сравнение

Beam vs Qwen 3.8 Max

0:13

Beam лидирует в 0 из 13 общих бенчмарков

Итог

Qwen 3.8 Max лидирует во всех 13 общих бенчмарках, хотя в некоторых случаях отрыв невелик (GPQA: 92.6 против 90.5, AA-LCR: 80.3 против 79.3, LongBench: 66.3 против 65.5). Qwen 3.8 Max — модель с 2.4 триллиона параметров и 95 миллиардами активных параметров на токен, то есть активных параметров у неё примерно в четыре раза больше, чем у Beam. Именно на эту разницу в вычислительных ресурсах указывает Reflection.

Сравнение по каждому бенчмарку

БенчмаркBeamQwen 3.8 MaxРазница
DeepSWE v1.144,451,0-6,6
SWE-Bench Pro v165,567,7-2,2
Terminal-Bench v2.180,186,6-6,5
Humanity's Last Exam (no tools)36,243,6-7,4
SciCode49,752,1-2,4
CritPt (AA)16,320,0-3,7
GPQA Diamond90,592,6-2,1
AutomationBench (public)37,039,8-2,8
MCP Atlas78,784,5-5,8
τ³ banking38,055,2-17,2
AA-LCR (long context)79,380,3-1,0
LongBench v265,566,3-0,8
IFBench79,782,8-3,1

Все результаты взяты из анонса Reflection (редакция от 8 октября 2026 года). Результаты для Qwen 3.8 Max приведены по данным Reflection, со ссылкой на Artificial Analysis и DataCurve.

Две модели

BeamQwen 3.8 Max
РазработчикReflection AIAlibaba (Qwen)
Базируется вСШАКитай
Параметры (всего / активных)501B / 23B2.4T / 95B
ВесаApache 2.0, обещана на более поздний срок в октябре 2026 годаQwen3.8-Max License (custom)
Дата выпуска5 октября 2026 г.3 августа 2026 г.
Как получить доступБета-API с листом ожидания; веса появятся позжеHugging Face, Alibaba Cloud Model Studio, OpenRouter

Другие сравнения