طريقة الاستخدام
كيفية استخدام Beam اليوم
يتوفر Beam حاليًا بنسخة تجريبية تُطرح تدريجيًا. إليك كل طرق الوصول إليه الآن، وشيفرة عملية لواجهة API المتوافقة مع OpenAI، وما سيتغير عند إتاحة الأوزان المفتوحة.
خياراتك المتاحة الآن
واجهة API التجريبية من Reflection
سجّل في منصة Reflection وانضم إلى قائمة الانتظار. بعد تفعيل إمكانية الوصول، يمكنك إنشاء مفاتيح API واستخدام Beam عبر نقطة نهاية متوافقة مع OpenAI.
انضم إلى قائمة الانتظارMirror CLI
وكيل البرمجة الخاص بـ Reflection لسطر الأوامر، متاح على macOS (Apple Silicon) وLinux. يستخدم Beam افتراضيًا، ويتطلب مفتاح API نفسه.
البدء السريع مع Mirrorالدردشة في المتصفح
BeamAI.chat موقع دردشة مستقل سينتقل إلى Beam فور إتاحته للجميع. وحتى ذلك الحين، يستخدم نموذجًا مفتوحًا مشابهًا، ويذكر ذلك بوضوح.
افتح BeamAI.chatتنزيل الأوزان
هذا غير ممكن بعد. وعدت Reflection بإتاحة الأوزان بموجب Apache 2.0 في وقت لاحق من أكتوبر 2026. نتابع الإطلاق يوميًا.
متتبّع الإصدارمن البداية إلى أول طلب
- 01
انضم إلى قائمة الانتظار
أنشئ حسابًا على platform.reflection.ai. ينتظر المسجّلون الجدد حتى تُفعّل إمكانية وصولهم.
- 02
أنشئ مفتاح API
في المنصة، افتح «مفاتيح API» وأنشئ مفتاحًا. خزّنه في متغير البيئة REFLECTION_API_KEY.
- 03
وجّه عميلك إلى Reflection
استخدم عنوان URL الأساسي https://api.reflection.ai/openai/v1 مع أي حزمة SDK من OpenAI، ومعرّف النموذج Beam-501B-A23B.
- 04
أرسل طلب إكمال محادثة
استخدم Chat Completions كالمعتاد. ويمكنك ضبط reasoning_effort للموازنة بين السرعة والعمق.
أمثلة برمجية
تتبع نقطة النهاية تنسيق OpenAI Chat Completions، لذا تعمل حزم OpenAI SDK الرسمية بعد تغيير عنوان URL الأساسي والمفتاح.
الطلب الأول
curl https://api.reflection.ai/openai/v1/chat/completions \
-H "Authorization: Bearer $REFLECTION_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "Beam-501B-A23B",
"messages": [{"role": "user", "content": "Explain Mixture-of-Experts in two sentences."}],
"reasoning_effort": "medium"
}'البث
stream = client.chat.completions.create(
model="Beam-501B-A23B",
messages=[{"role": "user", "content": "Write a haiku about sparse experts."}],
stream=True,
)
for chunk in stream:
delta = chunk.choices[0].delta
# reasoning arrives first in delta.reasoning_content, then the answer in delta.content
if delta.content:
print(delta.content, end="", flush=True)متغيرات البيئة
export REFLECTION_API_KEY="<your API key>"
# Tools that read the standard OpenAI variables and use Chat Completions
export OPENAI_BASE_URL="https://api.reflection.ai/openai/v1"
export OPENAI_API_KEY="$REFLECTION_API_KEY"
# Check which models your key can use
curl https://api.reflection.ai/openai/v1/models -H "Authorization: Bearer $REFLECTION_API_KEY"مستوى الاستدلال
يستدِل Beam دائمًا، ولا يمكن إيقاف ذلك. تتحكم المعلمة reasoning_effort في مقدار الاستدلال. القيمة الافتراضية هي medium.
| القيمة | السلوك |
|---|---|
| low | أقل قدر من الاستدلال وأقل زمن استجابة. للمهام البسيطة. |
| medium | توازن بين الجودة وزمن الاستجابة. تُستخدم عند عدم تحديد المعلمة. |
| high | استدلال أكثر للمسائل الأصعب. |
| xhigh | استدلال أكثر من high. |
| max | أقصى قدر من الاستدلال، لأصعب المسائل. |
تُحتسب رموز الاستدلال ضمن max_completion_tokens وحدود المعدل. إذا كان الحد منخفضًا جدًا، فقد ينفد ما لدى النموذج أثناء الاستدلال، فيُرجع إجابة فارغة مع finish_reason "length". ويُعاد نص الاستدلال بشكل منفصل ضمن reasoning_content.
ما الذي يعمل وما الذي لا يعمل
مدعوم
- POST /chat/completions, GET /models, GET /models/{model}
- البث، بما في ذلك بيانات الاستخدام في الجزء الأخير
- استدعاء الأدوات باستخدام tool_choice و parallel_tool_calls
- المخرجات المنظّمة: json_object و json_schema
- temperature و top_p و frequency_penalty و presence_penalty و max_completion_tokens و seed
- أدوار system و developer و user و assistant و tool
غير مدعوم
- واجهات API للاستجابات والتضمينات والصور والصوت والملفات والدفعات والمساعدين
- مدخلات الصور أو الصوت أو الملفات: Beam نصّي فقط
- n غير 1، logprobs، logit_bias
- المعلمات مثل user أو metadata أو audio أو prediction (تؤدي إلى ظهور خطأ)
- تُقبل تسلسلات الإيقاف، لكنها لا تؤثر في النتيجة
حدود الاستخدام
تُطبّق الحدود على مستوى المؤسسة، وتشمل عدد الطلبات والرموز في الدقيقة وفي اليوم بالتوقيت العالمي المنسق، إلى جانب حد أقصى للطلبات المتزامنة. يؤدي تجاوز أي حد إلى HTTP 429 مع ترويسة Retry-After. تُعاد تعيين الحدود اليومية عند 00:00 UTC. لم تنشر Reflection بعد طريقة طلب حدود أعلى، ولا توجد قائمة أسعار عامة للنسخة التجريبية.
وكلاء البرمجة
يتصل Mirror CLI بـ Beam باستخدام مفتاح API فقط. يعمل Pi وOpenCode وHermes من خلال إعدادات المزوّد المتوافقة مع OpenAI: عنوان URL الأساسي https://api.reflection.ai/openai/v1، والطراز Beam-501B-A23B، والمفتاح من REFLECTION_API_KEY. لا يدعم Mirror نظام Windows الأصلي.
curl -fsSL https://raw.githubusercontent.com/reflection-oss/mirror-beta/main/install.sh | bash
cd your-project
mirror # uses Reflection and Beam-501B-A23B by defaultتشغيل Beam بنفسك
عند إتاحة الأوزان، يمكن تشغيل Beam باستخدام محركات مفتوحة المصدر؛ وتقول Reflection إنها تعمل على توفير عمليات تكامل وشركاء للإطلاق. توقّع حاجة كبيرة إلى الذاكرة: يجب أن تكون جميع المعلمات البالغ عددها 501 مليارًا في ذاكرة GPU، رغم أن 23 مليارًا فقط تنشط لكل رمز. يعادل ذلك نحو 1 TB بصيغة BF16، و500 GB بصيغة FP8، و250 GB بدقة 4-bit، قبل احتساب ذاكرة KV المؤقتة.