Cara a cara
Beam vs Qwen 3.8 Max
0:13
Beam gana 0 de las 13 pruebas comparativas compartidas
Veredicto
Qwen 3.8 Max lidera en los 13 benchmarks compartidos, aunque varias diferencias son pequeñas (GPQA 92.6 frente a 90.5, AA-LCR 80.3 frente a 79.3, LongBench 66.3 frente a 65.5). Qwen 3.8 Max es un modelo de 2.4 billones de parámetros, con 95 mil millones activos por token, aproximadamente cuatro veces el tamaño activo de Beam, y esa es la diferencia de cómputo a la que apunta Reflection.
Prueba comparativa por prueba comparativa
| Benchmark | Beam | Qwen 3.8 Max | Diferencia | |
|---|---|---|---|---|
| DeepSWE v1.1 | 44,4 | 51,0 | -6,6 | |
| SWE-Bench Pro v1 | 65,5 | 67,7 | -2,2 | |
| Terminal-Bench v2.1 | 80,1 | 86,6 | -6,5 | |
| Humanity's Last Exam (no tools) | 36,2 | 43,6 | -7,4 | |
| SciCode | 49,7 | 52,1 | -2,4 | |
| CritPt (AA) | 16,3 | 20,0 | -3,7 | |
| GPQA Diamond | 90,5 | 92,6 | -2,1 | |
| AutomationBench (public) | 37,0 | 39,8 | -2,8 | |
| MCP Atlas | 78,7 | 84,5 | -5,8 | |
| τ³ banking | 38,0 | 55,2 | -17,2 | |
| AA-LCR (long context) | 79,3 | 80,3 | -1,0 | |
| LongBench v2 | 65,5 | 66,3 | -0,8 | |
| IFBench | 79,7 | 82,8 | -3,1 |
Todas las puntuaciones proceden del anuncio de Reflection (revisión del 8 de octubre de 2026). Las puntuaciones de Qwen 3.8 Max son las citadas por Reflection a partir de Artificial Analysis y DataCurve.
Los dos modelos
| Beam | Qwen 3.8 Max | |
|---|---|---|
| Desarrollador | Reflection AI | Alibaba (Qwen) |
| Sede | Estados Unidos | China |
| Parámetros (totales / activos) | 501B / 23B | 2.4T / 95B |
| Pesos | Apache 2.0, prometida para más adelante en octubre de 2026 | Qwen3.8-Max License (custom) |
| Lanzamiento | 5 de octubre de 2026 | 3 de agosto de 2026 |
| Cómo acceder | API beta con lista de espera; pesos próximamente | Hugging Face, Alibaba Cloud Model Studio, OpenRouter |
Otras comparaciones
Z.ai (Zhipu AI)
Beam vs GLM 5.2
Beam 8–513 pruebas comparativas compartidas
Moonshot AI
Beam vs Kimi K3
Beam 1–1314 pruebas comparativas compartidas
DeepSeek
Beam vs DeepSeek V4.1 Flash
Beam 2–79 pruebas comparativas compartidas
Z.ai (Zhipu AI)
Beam vs GLM 5.3
Beam 0–1212 pruebas comparativas compartidas
NVIDIA
Beam vs Nemotron 3 Ultra
Beam 13–115 pruebas comparativas compartidas
Thinking Machines Lab
Beam vs Inkling
Beam 13–215 pruebas comparativas compartidas