Direktvergleich
Beam vs Qwen 3.8 Max
0:13
Beam gewinnt 0 von 13 gemeinsamen Benchmarks
Fazit
Qwen 3.8 Max liegt bei allen 13 gemeinsamen Benchmarks vorne, auch wenn einige Abstände gering sind (GPQA 92.6 vs 90.5, AA-LCR 80.3 vs 79.3, LongBench 66.3 vs 65.5). Qwen 3.8 Max ist ein Modell mit 2.4 Billionen Parametern und 95 Milliarden aktiven Parametern pro Token, also etwa viermal so vielen aktiven Parametern wie Beam. Auf diesen Unterschied bei der Rechenleistung verweist Reflection.
Benchmark für Benchmark
| Benchmark | Beam | Qwen 3.8 Max | Differenz | |
|---|---|---|---|---|
| DeepSWE v1.1 | 44,4 | 51,0 | -6,6 | |
| SWE-Bench Pro v1 | 65,5 | 67,7 | -2,2 | |
| Terminal-Bench v2.1 | 80,1 | 86,6 | -6,5 | |
| Humanity's Last Exam (no tools) | 36,2 | 43,6 | -7,4 | |
| SciCode | 49,7 | 52,1 | -2,4 | |
| CritPt (AA) | 16,3 | 20,0 | -3,7 | |
| GPQA Diamond | 90,5 | 92,6 | -2,1 | |
| AutomationBench (public) | 37,0 | 39,8 | -2,8 | |
| MCP Atlas | 78,7 | 84,5 | -5,8 | |
| τ³ banking | 38,0 | 55,2 | -17,2 | |
| AA-LCR (long context) | 79,3 | 80,3 | -1,0 | |
| LongBench v2 | 65,5 | 66,3 | -0,8 | |
| IFBench | 79,7 | 82,8 | -3,1 |
Alle Werte stammen aus der Ankündigung von Reflection (überarbeitete Fassung vom 8. Oktober 2026). Die Werte für Qwen 3.8 Max sind die von Reflection zitierten Angaben von Artificial Analysis und DataCurve.
Die beiden Modelle
| Beam | Qwen 3.8 Max | |
|---|---|---|
| Entwickler | Reflection AI | Alibaba (Qwen) |
| Sitz | Vereinigte Staaten | China |
| Parameter (gesamt / aktiv) | 501B / 23B | 2.4T / 95B |
| Gewichte | Apache 2.0, für später im Oktober 2026 angekündigt | Qwen3.8-Max License (custom) |
| Veröffentlicht | 5. Oktober 2026 | 3. August 2026 |
| Zugriff | Beta-API mit Warteliste; Gewichte folgen | Hugging Face, Alibaba Cloud Model Studio, OpenRouter |
Weitere Vergleiche
Z.ai (Zhipu AI)
Beam vs GLM 5.2
Beam 8–513 gemeinsame Benchmarks
Moonshot AI
Beam vs Kimi K3
Beam 1–1314 gemeinsame Benchmarks
DeepSeek
Beam vs DeepSeek V4.1 Flash
Beam 2–79 gemeinsame Benchmarks
Z.ai (Zhipu AI)
Beam vs GLM 5.3
Beam 0–1212 gemeinsame Benchmarks
NVIDIA
Beam vs Nemotron 3 Ultra
Beam 13–115 gemeinsame Benchmarks
Thinking Machines Lab
Beam vs Inkling
Beam 13–215 gemeinsame Benchmarks