Przejdź do treści
reflectionbeam

Bezpośrednie porównanie

Beam vs Inkling

13:2

Beam wygrywa w 13 z 15 wspólnych benchmarków

Werdykt

Inkling od Thinking Machines Lab to drugi duży amerykański model z otwartymi wagami z 2026 roku; jest już dostępny na licencji Apache 2.0. Beam wygrywa z nim 13 z 15 wspólnych benchmarków, ze znaczną przewagą w SWE-Bench Pro, Terminal-Bench i CritPt. Inkling nieznacznie prowadzi w IFBench i indeksie AA Omniscience. Reflection zauważa, że w RL dla Inkling wykorzystano 30 milionów trajektorii, a dla Beam ponad 100 milionów.

Porównanie benchmark po benchmarku

BenchmarkBeamInklingRóżnica
SWE-Bench Pro v2-Hard77,256,9+20,3
SWE-Bench Pro v165,554,3+11,2
Terminal-Bench v2.180,163,8+16,3
SWE-Bench Verified80,977,6+3,3
AIME 202697,897,1+0,7
Humanity's Last Exam (no tools)36,229,7+6,5
SciCode49,746,1+3,6
CritPt (AA)16,35,4+10,9
GPQA Diamond90,587,2+3,3
MCP Atlas78,776,0+2,7
τ³ banking38,025,0+13,0
BrowseComp (context mgmt)77,477,1+0,3
AA-LCR (long context)79,377,3+2,0
IFBench79,779,8-0,1
AA Omniscience index (public split)13,014,2-1,2

Wszystkie wyniki pochodzą z ogłoszenia Reflection (aktualizacja z 8 października 2026). Wyniki dla Inkling podano za Reflection, na podstawie danych Artificial Analysis i DataCurve.

Oba modele

BeamInkling
DeweloperReflection AIThinking Machines Lab
SiedzibaStany ZjednoczoneStany Zjednoczone
Parametry (łącznie / aktywne)501B / 23B975B / 41B
WagiApache 2.0, obiecana na późniejszą część października 2026Apache 2.0
Data premiery5 października 202615 lipca 2026
Jak uzyskać dostępAPI beta — lista oczekujących; wagi pojawią się późniejHugging Face, Tinker API

Pozostałe porównania