Confronto direto
Beam vs Inkling
13:2
Beam vence em 13 dos 15 benchmarks em comum
Veredito
Inkling, da Thinking Machines Lab, é o outro grande modelo de pesos abertos dos EUA de 2026 e já é lançado sob Apache 2.0. Beam vence em 13 dos 15 benchmarks em comum, com grandes vantagens em SWE-Bench Pro, Terminal-Bench e CritPt. Inkling está ligeiramente à frente em IFBench e no índice AA Omniscience. A Reflection observa que o RL de Inkling usou 30 milhões de rollouts, contra mais de 100 milhões para Beam.
Benchmark por benchmark
| Benchmark | Beam | Inkling | Diferença | |
|---|---|---|---|---|
| SWE-Bench Pro v2-Hard | 77,2 | 56,9 | +20,3 | |
| SWE-Bench Pro v1 | 65,5 | 54,3 | +11,2 | |
| Terminal-Bench v2.1 | 80,1 | 63,8 | +16,3 | |
| SWE-Bench Verified | 80,9 | 77,6 | +3,3 | |
| AIME 2026 | 97,8 | 97,1 | +0,7 | |
| Humanity's Last Exam (no tools) | 36,2 | 29,7 | +6,5 | |
| SciCode | 49,7 | 46,1 | +3,6 | |
| CritPt (AA) | 16,3 | 5,4 | +10,9 | |
| GPQA Diamond | 90,5 | 87,2 | +3,3 | |
| MCP Atlas | 78,7 | 76,0 | +2,7 | |
| τ³ banking | 38,0 | 25,0 | +13,0 | |
| BrowseComp (context mgmt) | 77,4 | 77,1 | +0,3 | |
| AA-LCR (long context) | 79,3 | 77,3 | +2,0 | |
| IFBench | 79,7 | 79,8 | -0,1 | |
| AA Omniscience index (public split) | 13,0 | 14,2 | -1,2 |
Todas as pontuações vêm do anúncio da Reflection (revisão de 8 de outubro de 2026). As pontuações de Inkling são as citadas pela Reflection, com base em Artificial Analysis e DataCurve.
Os dois modelos
| Beam | Inkling | |
|---|---|---|
| Desenvolvedor | Reflection AI | Thinking Machines Lab |
| Sediado em | Estados Unidos | Estados Unidos |
| Parâmetros (total / ativos) | 501B / 23B | 975B / 41B |
| Pesos | Apache 2.0, prometida para mais tarde em outubro de 2026 | Apache 2.0 |
| Lançado | 5 de outubro de 2026 | 15 de julho de 2026 |
| Como acessar | API beta com lista de espera; pesos a caminho | Hugging Face, Tinker API |
Outras comparações
Z.ai (Zhipu AI)
Beam vs GLM 5.2
Beam 8–513 benchmarks em comum
Moonshot AI
Beam vs Kimi K3
Beam 1–1314 benchmarks em comum
Alibaba (Qwen)
Beam vs Qwen 3.8 Max
Beam 0–1313 benchmarks em comum
DeepSeek
Beam vs DeepSeek V4.1 Flash
Beam 2–79 benchmarks em comum
Z.ai (Zhipu AI)
Beam vs GLM 5.3
Beam 0–1212 benchmarks em comum
NVIDIA
Beam vs Nemotron 3 Ultra
Beam 13–115 benchmarks em comum