انتقل إلى المحتوى
reflectionbeam

مواجهة مباشرة

Beam vs Kimi K3

1:13

يتفوّق Beam في 1 من أصل 14 من المعايير المشتركة

الخلاصة

تذكر Reflection نفسها أن Kimi K3 هو النموذج الذي لا يزال متقدمًا من حيث القدرات الخام. يتفوق Kimi K3 في 13 من أصل 14 معيارًا مشتركًا، وغالبًا بفارق 10 نقاط أو أكثر في البرمجة والبحث باستخدام الوكلاء. فوز Beam الوحيد هو في τ³ banking. والمقابل هو الحجم: يضم Kimi K3‏ 2.8 تريليون معلمة، منها 104 مليارات فعّالة لكل رمز، أي نحو 4.5 أضعاف 23 مليارًا لدى Beam، وتبلغ أحجام أوزانه نحو 1.4 TB حتى بصيغة 4-bit.

مقارنة معيارًا بمعيار

المعيارBeamKimi K3الفارق
DeepSWE v1.144.468.0‎-23.6
SWE-Bench Pro v2-Hard77.288.2‎-11.0
Terminal-Bench v2.180.188.3‎-8.2
SWE Atlas Codebase QnA34.668.0‎-33.4
Humanity's Last Exam (no tools)36.246.9‎-10.7
SciCode49.758.7‎-9.0
CritPt (AA)16.323.4‎-7.1
GPQA Diamond90.593.5‎-3.0
AutomationBench (public)37.046.7‎-9.7
MCP Atlas78.782.3‎-3.6
τ³ banking38.037.1‎+0.9
BrowseComp (context mgmt)77.491.2‎-13.8
DeepSearchQA (context mgmt)80.195.0‎-14.9
AA-LCR (long context)79.388.7‎-9.4

جميع الدرجات مأخوذة من إعلان Reflection (مراجعة 8 أكتوبر 2026). أما درجات Kimi K3 فهي كما أوردتها Reflection نقلًا عن Artificial Analysis وDataCurve.

النموذجان

BeamKimi K3
المطوّرReflection AIMoonshot AI
المقرالولايات المتحدةالصين
عدد المعلمات (الإجمالي / النشط)501B / 23B2.8T / 104B
الأوزانApache 2.0، مع التعهّد بإتاحته لاحقًا في أكتوبر 2026Kimi K3 License (custom)
تاريخ الإصدار5 أكتوبر 202616 يوليو 2026
طريقة الوصولواجهة API تجريبية بقائمة انتظار؛ الأوزان قادمةHugging Face, Moonshot API, OpenRouter

مقارنات أخرى