Vai al contenuto
reflectionbeam

Confronto diretto

Beam vs Kimi K3

1:13

Beam vince 1 dei 14 benchmark in comune

Verdetto

Reflection stessa indica Kimi K3 come il modello che resta in vantaggio in termini di capacità assoluta. Kimi K3 vince 13 dei 14 benchmark condivisi, spesso con almeno 10 punti di vantaggio nella programmazione agentica e nella ricerca. L'unica vittoria di Beam è su τ³ banking. Il compromesso riguarda le dimensioni: Kimi K3 ha 2.8 trilioni di parametri, di cui 104 miliardi attivi per token, circa 4.5 volte i 23 miliardi di Beam, e i suoi pesi occupano circa 1.4 TB anche in formato a 4 bit.

Confronto benchmark per benchmark

BenchmarkBeamKimi K3Differenza
DeepSWE v1.144,468,0-23,6
SWE-Bench Pro v2-Hard77,288,2-11,0
Terminal-Bench v2.180,188,3-8,2
SWE Atlas Codebase QnA34,668,0-33,4
Humanity's Last Exam (no tools)36,246,9-10,7
SciCode49,758,7-9,0
CritPt (AA)16,323,4-7,1
GPQA Diamond90,593,5-3,0
AutomationBench (public)37,046,7-9,7
MCP Atlas78,782,3-3,6
τ³ banking38,037,1+0,9
BrowseComp (context mgmt)77,491,2-13,8
DeepSearchQA (context mgmt)80,195,0-14,9
AA-LCR (long context)79,388,7-9,4

Tutti i punteggi provengono dall'annuncio di Reflection (revisione dell'8 ottobre 2026). I punteggi di Kimi K3 sono quelli citati da Reflection, tratti da Artificial Analysis e DataCurve.

I due modelli

BeamKimi K3
SviluppatoreReflection AIMoonshot AI
Con sede inStati UnitiCina
Parametri (totali / attivi)501B / 23B2.8T / 104B
PesiApache 2.0, promesso per la fine di ottobre 2026Kimi K3 License (custom)
Data di rilascio5 ottobre 202616 luglio 2026
Come accedereAPI beta con lista d'attesa; i pesi arriverannoHugging Face, Moonshot API, OpenRouter

Altri confronti