Przejdź do treści
reflectionbeam

Bezpośrednie porównanie

Beam vs Kimi K3

1:13

Beam wygrywa w 1 z 14 wspólnych benchmarków

Werdykt

Sama Reflection wskazuje Kimi K3 jako model, który nadal ma przewagę pod względem surowych możliwości. Kimi K3 wygrywa 13 z 14 wspólnych benchmarków, często o co najmniej 10 punktów w kodowaniu agentowym i wyszukiwaniu. Beam wygrywa tylko w τ³ banking. Kompromisem jest rozmiar: Kimi K3 ma 2.8 biliona parametrów, z których 104 miliardy są aktywne na token — około 4.5 raza więcej niż 23 miliardy w Beam — a jego wagi zajmują około 1.4 TB nawet w formacie 4-bitowym.

Porównanie benchmark po benchmarku

BenchmarkBeamKimi K3Różnica
DeepSWE v1.144,468,0-23,6
SWE-Bench Pro v2-Hard77,288,2-11,0
Terminal-Bench v2.180,188,3-8,2
SWE Atlas Codebase QnA34,668,0-33,4
Humanity's Last Exam (no tools)36,246,9-10,7
SciCode49,758,7-9,0
CritPt (AA)16,323,4-7,1
GPQA Diamond90,593,5-3,0
AutomationBench (public)37,046,7-9,7
MCP Atlas78,782,3-3,6
τ³ banking38,037,1+0,9
BrowseComp (context mgmt)77,491,2-13,8
DeepSearchQA (context mgmt)80,195,0-14,9
AA-LCR (long context)79,388,7-9,4

Wszystkie wyniki pochodzą z ogłoszenia Reflection (aktualizacja z 8 października 2026). Wyniki dla Kimi K3 podano za Reflection, na podstawie danych Artificial Analysis i DataCurve.

Oba modele

BeamKimi K3
DeweloperReflection AIMoonshot AI
SiedzibaStany ZjednoczoneChiny
Parametry (łącznie / aktywne)501B / 23B2.8T / 104B
WagiApache 2.0, obiecana na późniejszą część października 2026Kimi K3 License (custom)
Data premiery5 października 202616 lipca 2026
Jak uzyskać dostępAPI beta — lista oczekujących; wagi pojawią się późniejHugging Face, Moonshot API, OpenRouter

Pozostałe porównania