Adu langsung
Beam vs DeepSeek V4.1 Flash
Beam unggul pada 2 dari 9 benchmark yang sama
Kesimpulan
DeepSeek V4.1 Flash unggul pada 7 dari 9 benchmark yang sama, dengan keunggulan besar pada DeepSWE dan AutomationBench serta keunggulan 10 poin pada Terminal-Bench. Beam menang pada CritPt dan memiliki indeks AA Omniscience yang lebih baik, yang memberi penalti pada jawaban salah yang disampaikan dengan yakin. Dalam hal efisiensi, Beam tidak unggul di sini: DeepSeek V4.1 Flash hanya mengaktifkan 16 miliar parameter per token yang dihasilkan, lebih sedikit daripada 23 miliar milik Beam, dan bobotnya sudah tersedia untuk publik dengan lisensi MIT.
Perbandingan per benchmark
| Benchmark | Beam | DeepSeek V4.1 Flash | Selisih | |
|---|---|---|---|---|
| DeepSWE v1.1 | 44,4 | 74,2 | -29,8 | |
| Terminal-Bench v2.1 | 80,1 | 90,6 | -10,5 | |
| Humanity's Last Exam (no tools) | 36,2 | 39,1 | -2,9 | |
| SciCode | 49,7 | 52,0 | -2,3 | |
| CritPt (AA) | 16,3 | 14,3 | +2,0 | |
| GPQA Diamond | 90,5 | 90,9 | -0,4 | |
| AutomationBench (public) | 37,0 | 54,8 | -17,8 | |
| AA-LCR (long context) | 79,3 | 84,0 | -4,7 | |
| AA Omniscience index (public split) | 13,0 | 6,6 | +6,4 |
Semua skor berasal dari pengumuman Reflection (revisi 8 Oktober 2026). Skor untuk DeepSeek V4.1 Flash adalah sebagaimana dikutip Reflection dari Artificial Analysis dan DataCurve.
Kedua model
| Beam | DeepSeek V4.1 Flash | |
|---|---|---|
| Developer | Reflection AI | DeepSeek |
| Berbasis di | Amerika Serikat | China |
| Parameter (total / aktif) | 501B / 23B | 552B / 16B |
| Bobot | Apache 2.0, dijanjikan hadir nanti pada Oktober 2026 | MIT |
| Dirilis | 5 Oktober 2026 | 10 September 2026 |
| Cara mengakses | API beta masuk daftar tunggu; bobot segera hadir | Hugging Face, DeepSeek API, OpenRouter |
Perbandingan lainnya
Z.ai (Zhipu AI)
Beam vs GLM 5.2
Moonshot AI
Beam vs Kimi K3
Alibaba (Qwen)
Beam vs Qwen 3.8 Max
Z.ai (Zhipu AI)
Beam vs GLM 5.3
NVIDIA
Beam vs Nemotron 3 Ultra
Thinking Machines Lab