Bire bir karşılaştırma
Beam vs GLM 5.2
Beam, ortak kıyaslamaların 13 tanesinden 8 tanesini kazanıyor
Sonuç
Reflection, başlık iddiası için özellikle bu karşılaştırmayı seçti ve Beam bu karşılaştırmada güçlü bir performans sergiliyor: ortak 13 benchmark'ın 8'inde, SWE-Bench Pro v1, MCP Atlas, AutomationBench ve IFBench dahil, önde. GLM 5.2 ise zorlu akıl yürütme benchmark'larında (AIME, HLE, GPQA, CritPt) ve az farkla Terminal-Bench'te önde. Reflection, Beam'in benzer akıl yürütme puanlarına üç ila dört kat daha az çıkarım hesaplamasıyla ulaştığını söylüyor.
Kıyaslama bazında
| Kıyaslama | Beam | GLM 5.2 | Fark | |
|---|---|---|---|---|
| DeepSWE v1.1 | 44,4 | 44,0 | +0,4 | |
| SWE-Bench Pro v1 | 65,5 | 62,1 | +3,4 | |
| Terminal-Bench v2.1 | 80,1 | 81,0 | -0,9 | |
| AIME 2026 | 97,8 | 99,2 | -1,4 | |
| Humanity's Last Exam (no tools) | 36,2 | 40,5 | -4,3 | |
| CritPt (AA) | 16,3 | 20,9 | -4,6 | |
| GPQA Diamond | 90,5 | 91,2 | -0,7 | |
| AutomationBench (public) | 37,0 | 26,2 | +10,8 | |
| MCP Atlas | 78,7 | 77,8 | +0,9 | |
| τ³ banking | 38,0 | 37,1 | +0,9 | |
| AA-LCR (long context) | 79,3 | 78,3 | +1,0 | |
| LongBench v2 | 65,5 | 64,0 | +1,5 | |
| IFBench | 79,7 | 73,3 | +6,4 |
Tüm puanlar Reflection'ın duyurusundan (8 Ekim 2026 tarihli revizyon) alınmıştır. GLM 5.2 puanları, Reflection'ın Artificial Analysis ve DataCurve'den aktardığı puanlardır.
İki model
| Beam | GLM 5.2 | |
|---|---|---|
| Geliştirici | Reflection AI | Z.ai (Zhipu AI) |
| Merkez | Amerika Birleşik Devletleri | Çin |
| Parametreler (toplam / etkin) | 501B / 23B | 753B / 40B |
| Ağırlıklar | Apache 2.0, Ekim 2026'nın ilerleyen günlerinde sunulacağı vaat edildi | MIT |
| Yayınlandı | 5 Ekim 2026 | 16 Haziran 2026 |
| Nasıl erişilir | Bekleme listeli beta API; ağırlıklar yakında | Hugging Face, Z.ai API, OpenRouter |
Diğer karşılaştırmalar
Moonshot AI
Beam vs Kimi K3
Alibaba (Qwen)
Beam vs Qwen 3.8 Max
DeepSeek
Beam vs DeepSeek V4.1 Flash
Z.ai (Zhipu AI)
Beam vs GLM 5.3
NVIDIA
Beam vs Nemotron 3 Ultra
Thinking Machines Lab