انتقل إلى المحتوى
reflectionbeam

مواجهة مباشرة

Beam vs DeepSeek V4.1 Flash

2:7

يتفوّق Beam في 2 من أصل 9 من المعايير المشتركة

الخلاصة

يتقدم DeepSeek V4.1 Flash في 7 من أصل 9 معايير مشتركة، بفوارق كبيرة في DeepSWE وAutomationBench، وبفارق 10 نقاط في Terminal-Bench. يفوز Beam في CritPt، ولديه مؤشر AA Omniscience أفضل، وهو مؤشر يعاقب الإجابات الخاطئة الواثقة. الكفاءة لا ترجّح كفة Beam هنا: لا يفعّل DeepSeek V4.1 Flash سوى 16 مليار معلمة لكل رمز مُولّد، أي أقل من 23 مليارًا لدى Beam، وأوزانه متاحة للجميع بالفعل بموجب MIT.

مقارنة معيارًا بمعيار

المعيارBeamDeepSeek V4.1 Flashالفارق
DeepSWE v1.144.474.2‎-29.8
Terminal-Bench v2.180.190.6‎-10.5
Humanity's Last Exam (no tools)36.239.1‎-2.9
SciCode49.752.0‎-2.3
CritPt (AA)16.314.3‎+2.0
GPQA Diamond90.590.9‎-0.4
AutomationBench (public)37.054.8‎-17.8
AA-LCR (long context)79.384.0‎-4.7
AA Omniscience index (public split)13.06.6‎+6.4

جميع الدرجات مأخوذة من إعلان Reflection (مراجعة 8 أكتوبر 2026). أما درجات DeepSeek V4.1 Flash فهي كما أوردتها Reflection نقلًا عن Artificial Analysis وDataCurve.

النموذجان

BeamDeepSeek V4.1 Flash
المطوّرReflection AIDeepSeek
المقرالولايات المتحدةالصين
عدد المعلمات (الإجمالي / النشط)501B / 23B552B / 16B
الأوزانApache 2.0، مع التعهّد بإتاحته لاحقًا في أكتوبر 2026MIT
تاريخ الإصدار5 أكتوبر 202610 سبتمبر 2026
طريقة الوصولواجهة API تجريبية بقائمة انتظار؛ الأوزان قادمةHugging Face, DeepSeek API, OpenRouter

مقارنات أخرى