مواجهة مباشرة
Beam vs DeepSeek V4.1 Flash
2:7
يتفوّق Beam في 2 من أصل 9 من المعايير المشتركة
الخلاصة
يتقدم DeepSeek V4.1 Flash في 7 من أصل 9 معايير مشتركة، بفوارق كبيرة في DeepSWE وAutomationBench، وبفارق 10 نقاط في Terminal-Bench. يفوز Beam في CritPt، ولديه مؤشر AA Omniscience أفضل، وهو مؤشر يعاقب الإجابات الخاطئة الواثقة. الكفاءة لا ترجّح كفة Beam هنا: لا يفعّل DeepSeek V4.1 Flash سوى 16 مليار معلمة لكل رمز مُولّد، أي أقل من 23 مليارًا لدى Beam، وأوزانه متاحة للجميع بالفعل بموجب MIT.
مقارنة معيارًا بمعيار
| المعيار | Beam | DeepSeek V4.1 Flash | الفارق | |
|---|---|---|---|---|
| DeepSWE v1.1 | 44.4 | 74.2 | -29.8 | |
| Terminal-Bench v2.1 | 80.1 | 90.6 | -10.5 | |
| Humanity's Last Exam (no tools) | 36.2 | 39.1 | -2.9 | |
| SciCode | 49.7 | 52.0 | -2.3 | |
| CritPt (AA) | 16.3 | 14.3 | +2.0 | |
| GPQA Diamond | 90.5 | 90.9 | -0.4 | |
| AutomationBench (public) | 37.0 | 54.8 | -17.8 | |
| AA-LCR (long context) | 79.3 | 84.0 | -4.7 | |
| AA Omniscience index (public split) | 13.0 | 6.6 | +6.4 |
جميع الدرجات مأخوذة من إعلان Reflection (مراجعة 8 أكتوبر 2026). أما درجات DeepSeek V4.1 Flash فهي كما أوردتها Reflection نقلًا عن Artificial Analysis وDataCurve.
النموذجان
| Beam | DeepSeek V4.1 Flash | |
|---|---|---|
| المطوّر | Reflection AI | DeepSeek |
| المقر | الولايات المتحدة | الصين |
| عدد المعلمات (الإجمالي / النشط) | 501B / 23B | 552B / 16B |
| الأوزان | Apache 2.0، مع التعهّد بإتاحته لاحقًا في أكتوبر 2026 | MIT |
| تاريخ الإصدار | 5 أكتوبر 2026 | 10 سبتمبر 2026 |
| طريقة الوصول | واجهة API تجريبية بقائمة انتظار؛ الأوزان قادمة | Hugging Face, DeepSeek API, OpenRouter |
مقارنات أخرى
Z.ai (Zhipu AI)
Beam vs GLM 5.2
Beam 8–513 معيارًا مشتركًا
Moonshot AI
Beam vs Kimi K3
Beam 1–1314 معيارًا مشتركًا
Alibaba (Qwen)
Beam vs Qwen 3.8 Max
Beam 0–1313 معيارًا مشتركًا
Z.ai (Zhipu AI)
Beam vs GLM 5.3
Beam 0–1212 معيارًا مشتركًا
NVIDIA
Beam vs Nemotron 3 Ultra
Beam 13–115 معيارًا مشتركًا
Thinking Machines Lab
Beam vs Inkling
Beam 13–215 معيارًا مشتركًا