Direktvergleich
Beam vs Inkling
Beam gewinnt 13 von 15 gemeinsamen Benchmarks
Fazit
Inkling von Thinking Machines Lab ist das andere große offene US-Modell mit offenen Gewichten aus dem Jahr 2026 und bereits unter Apache 2.0 verfügbar. Beam schlägt es bei 13 der 15 gemeinsamen Benchmarks, mit deutlichem Vorsprung bei SWE-Bench Pro, Terminal-Bench und CritPt. Inkling liegt bei IFBench und dem AA Omniscience-Index knapp vorne. Reflection merkt an, dass beim RL-Training von Inkling 30 Millionen Rollouts zum Einsatz kamen, gegenüber mehr als 100 Millionen bei Beam.
Benchmark für Benchmark
| Benchmark | Beam | Inkling | Differenz | |
|---|---|---|---|---|
| SWE-Bench Pro v2-Hard | 77,2 | 56,9 | +20,3 | |
| SWE-Bench Pro v1 | 65,5 | 54,3 | +11,2 | |
| Terminal-Bench v2.1 | 80,1 | 63,8 | +16,3 | |
| SWE-Bench Verified | 80,9 | 77,6 | +3,3 | |
| AIME 2026 | 97,8 | 97,1 | +0,7 | |
| Humanity's Last Exam (no tools) | 36,2 | 29,7 | +6,5 | |
| SciCode | 49,7 | 46,1 | +3,6 | |
| CritPt (AA) | 16,3 | 5,4 | +10,9 | |
| GPQA Diamond | 90,5 | 87,2 | +3,3 | |
| MCP Atlas | 78,7 | 76,0 | +2,7 | |
| τ³ banking | 38,0 | 25,0 | +13,0 | |
| BrowseComp (context mgmt) | 77,4 | 77,1 | +0,3 | |
| AA-LCR (long context) | 79,3 | 77,3 | +2,0 | |
| IFBench | 79,7 | 79,8 | -0,1 | |
| AA Omniscience index (public split) | 13,0 | 14,2 | -1,2 |
Alle Werte stammen aus der Ankündigung von Reflection (überarbeitete Fassung vom 8. Oktober 2026). Die Werte für Inkling sind die von Reflection zitierten Angaben von Artificial Analysis und DataCurve.
Die beiden Modelle
| Beam | Inkling | |
|---|---|---|
| Entwickler | Reflection AI | Thinking Machines Lab |
| Sitz | Vereinigte Staaten | Vereinigte Staaten |
| Parameter (gesamt / aktiv) | 501B / 23B | 975B / 41B |
| Gewichte | Apache 2.0, für später im Oktober 2026 angekündigt | Apache 2.0 |
| Veröffentlicht | 5. Oktober 2026 | 15. Juli 2026 |
| Zugriff | Beta-API mit Warteliste; Gewichte folgen | Hugging Face, Tinker API |
Weitere Vergleiche
Z.ai (Zhipu AI)
Beam vs GLM 5.2
Moonshot AI
Beam vs Kimi K3
Alibaba (Qwen)
Beam vs Qwen 3.8 Max
DeepSeek
Beam vs DeepSeek V4.1 Flash
Z.ai (Zhipu AI)
Beam vs GLM 5.3
NVIDIA