Bire bir karşılaştırma
Beam vs DeepSeek V4.1 Flash
Beam, ortak kıyaslamaların 9 tanesinden 2 tanesini kazanıyor
Sonuç
DeepSeek V4.1 Flash, ortak 9 benchmark'ın 7'sinde önde; DeepSWE ve AutomationBench'te büyük, Terminal-Bench'te ise 10 puanlık farkla kazanıyor. Beam, CritPt'te kazanıyor ve kendinden emin biçimde verilen yanlış yanıtları cezalandıran AA Omniscience endeksinde daha iyi sonuç alıyor. Bu karşılaştırmada verimlilik Beam'in lehine değil: DeepSeek V4.1 Flash, üretilen token başına yalnızca 16 milyar parametre etkinleştiriyor; bu, Beam'in 23 milyarından daha az. Ayrıca ağırlıkları MIT lisansı altında zaten kamuya açık.
Kıyaslama bazında
| Kıyaslama | Beam | DeepSeek V4.1 Flash | Fark | |
|---|---|---|---|---|
| DeepSWE v1.1 | 44,4 | 74,2 | -29,8 | |
| Terminal-Bench v2.1 | 80,1 | 90,6 | -10,5 | |
| Humanity's Last Exam (no tools) | 36,2 | 39,1 | -2,9 | |
| SciCode | 49,7 | 52,0 | -2,3 | |
| CritPt (AA) | 16,3 | 14,3 | +2,0 | |
| GPQA Diamond | 90,5 | 90,9 | -0,4 | |
| AutomationBench (public) | 37,0 | 54,8 | -17,8 | |
| AA-LCR (long context) | 79,3 | 84,0 | -4,7 | |
| AA Omniscience index (public split) | 13,0 | 6,6 | +6,4 |
Tüm puanlar Reflection'ın duyurusundan (8 Ekim 2026 tarihli revizyon) alınmıştır. DeepSeek V4.1 Flash puanları, Reflection'ın Artificial Analysis ve DataCurve'den aktardığı puanlardır.
İki model
| Beam | DeepSeek V4.1 Flash | |
|---|---|---|
| Geliştirici | Reflection AI | DeepSeek |
| Merkez | Amerika Birleşik Devletleri | Çin |
| Parametreler (toplam / etkin) | 501B / 23B | 552B / 16B |
| Ağırlıklar | Apache 2.0, Ekim 2026'nın ilerleyen günlerinde sunulacağı vaat edildi | MIT |
| Yayınlandı | 5 Ekim 2026 | 10 Eylül 2026 |
| Nasıl erişilir | Bekleme listeli beta API; ağırlıklar yakında | Hugging Face, DeepSeek API, OpenRouter |
Diğer karşılaştırmalar
Z.ai (Zhipu AI)
Beam vs GLM 5.2
Moonshot AI
Beam vs Kimi K3
Alibaba (Qwen)
Beam vs Qwen 3.8 Max
Z.ai (Zhipu AI)
Beam vs GLM 5.3
NVIDIA
Beam vs Nemotron 3 Ultra
Thinking Machines Lab