Перейти к содержимому
reflectionbeam

Лобовое сравнение

Beam vs Kimi K3

1:13

Beam лидирует в 1 из 14 общих бенчмарков

Итог

Сама Reflection называет Kimi K3 моделью, которая по-прежнему превосходит Beam по чистым возможностям. Kimi K3 выигрывает в 13 из 14 общих бенчмарков, часто опережая на 10 баллов и более в агентном программировании и поиске. Единственная победа Beam — τ³ banking. Разница — в размере: у Kimi K3 2.8 триллиона параметров, из которых 104 миллиарда активны на токен, — примерно в 4.5 раза больше, чем 23 миллиарда у Beam; даже в формате 4-bit веса занимают около 1.4 TB.

Сравнение по каждому бенчмарку

БенчмаркBeamKimi K3Разница
DeepSWE v1.144,468,0-23,6
SWE-Bench Pro v2-Hard77,288,2-11,0
Terminal-Bench v2.180,188,3-8,2
SWE Atlas Codebase QnA34,668,0-33,4
Humanity's Last Exam (no tools)36,246,9-10,7
SciCode49,758,7-9,0
CritPt (AA)16,323,4-7,1
GPQA Diamond90,593,5-3,0
AutomationBench (public)37,046,7-9,7
MCP Atlas78,782,3-3,6
τ³ banking38,037,1+0,9
BrowseComp (context mgmt)77,491,2-13,8
DeepSearchQA (context mgmt)80,195,0-14,9
AA-LCR (long context)79,388,7-9,4

Все результаты взяты из анонса Reflection (редакция от 8 октября 2026 года). Результаты для Kimi K3 приведены по данным Reflection, со ссылкой на Artificial Analysis и DataCurve.

Две модели

BeamKimi K3
РазработчикReflection AIMoonshot AI
Базируется вСШАКитай
Параметры (всего / активных)501B / 23B2.8T / 104B
ВесаApache 2.0, обещана на более поздний срок в октябре 2026 годаKimi K3 License (custom)
Дата выпуска5 октября 2026 г.16 июля 2026 г.
Как получить доступБета-API с листом ожидания; веса появятся позжеHugging Face, Moonshot API, OpenRouter

Другие сравнения