انتقل إلى المحتوى
reflectionbeam

طريقة الاستخدام

كيفية استخدام Beam اليوم

يتوفر Beam حاليًا بنسخة تجريبية تُطرح تدريجيًا. إليك كل طرق الوصول إليه الآن، وشيفرة عملية لواجهة API المتوافقة مع OpenAI، وما سيتغير عند إتاحة الأوزان المفتوحة.

خياراتك المتاحة الآن

من البداية إلى أول طلب

  1. 01

    انضم إلى قائمة الانتظار

    أنشئ حسابًا على platform.reflection.ai. ينتظر المسجّلون الجدد حتى تُفعّل إمكانية وصولهم.

  2. 02

    أنشئ مفتاح API

    في المنصة، افتح «مفاتيح API» وأنشئ مفتاحًا. خزّنه في متغير البيئة REFLECTION_API_KEY.

  3. 03

    وجّه عميلك إلى Reflection

    استخدم عنوان URL الأساسي https://api.reflection.ai/openai/v1 مع أي حزمة SDK من OpenAI، ومعرّف النموذج Beam-501B-A23B.

  4. 04

    أرسل طلب إكمال محادثة

    استخدم Chat Completions كالمعتاد. ويمكنك ضبط reasoning_effort للموازنة بين السرعة والعمق.

أمثلة برمجية

تتبع نقطة النهاية تنسيق OpenAI Chat Completions، لذا تعمل حزم OpenAI SDK الرسمية بعد تغيير عنوان URL الأساسي والمفتاح.

الطلب الأول

curl https://api.reflection.ai/openai/v1/chat/completions \
  -H "Authorization: Bearer $REFLECTION_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "Beam-501B-A23B",
    "messages": [{"role": "user", "content": "Explain Mixture-of-Experts in two sentences."}],
    "reasoning_effort": "medium"
  }'

البث

stream = client.chat.completions.create(
    model="Beam-501B-A23B",
    messages=[{"role": "user", "content": "Write a haiku about sparse experts."}],
    stream=True,
)

for chunk in stream:
    delta = chunk.choices[0].delta
    # reasoning arrives first in delta.reasoning_content, then the answer in delta.content
    if delta.content:
        print(delta.content, end="", flush=True)

متغيرات البيئة

export REFLECTION_API_KEY="<your API key>"

# Tools that read the standard OpenAI variables and use Chat Completions
export OPENAI_BASE_URL="https://api.reflection.ai/openai/v1"
export OPENAI_API_KEY="$REFLECTION_API_KEY"

# Check which models your key can use
curl https://api.reflection.ai/openai/v1/models -H "Authorization: Bearer $REFLECTION_API_KEY"

مستوى الاستدلال

يستدِل Beam دائمًا، ولا يمكن إيقاف ذلك. تتحكم المعلمة reasoning_effort في مقدار الاستدلال. القيمة الافتراضية هي medium.

القيمةالسلوك
lowأقل قدر من الاستدلال وأقل زمن استجابة. للمهام البسيطة.
mediumتوازن بين الجودة وزمن الاستجابة. تُستخدم عند عدم تحديد المعلمة.
highاستدلال أكثر للمسائل الأصعب.
xhighاستدلال أكثر من high.
maxأقصى قدر من الاستدلال، لأصعب المسائل.

تُحتسب رموز الاستدلال ضمن max_completion_tokens وحدود المعدل. إذا كان الحد منخفضًا جدًا، فقد ينفد ما لدى النموذج أثناء الاستدلال، فيُرجع إجابة فارغة مع finish_reason "length". ويُعاد نص الاستدلال بشكل منفصل ضمن reasoning_content.

ما الذي يعمل وما الذي لا يعمل

مدعوم

  • POST /chat/completions, GET /models, GET /models/{model}
  • البث، بما في ذلك بيانات الاستخدام في الجزء الأخير
  • استدعاء الأدوات باستخدام tool_choice و parallel_tool_calls
  • المخرجات المنظّمة: json_object و json_schema
  • temperature و top_p و frequency_penalty و presence_penalty و max_completion_tokens و seed
  • أدوار system و developer و user و assistant و tool

غير مدعوم

  • واجهات API للاستجابات والتضمينات والصور والصوت والملفات والدفعات والمساعدين
  • مدخلات الصور أو الصوت أو الملفات: Beam نصّي فقط
  • n غير 1، logprobs، logit_bias
  • المعلمات مثل user أو metadata أو audio أو prediction (تؤدي إلى ظهور خطأ)
  • تُقبل تسلسلات الإيقاف، لكنها لا تؤثر في النتيجة

حدود الاستخدام

تُطبّق الحدود على مستوى المؤسسة، وتشمل عدد الطلبات والرموز في الدقيقة وفي اليوم بالتوقيت العالمي المنسق، إلى جانب حد أقصى للطلبات المتزامنة. يؤدي تجاوز أي حد إلى HTTP 429 مع ترويسة Retry-After. تُعاد تعيين الحدود اليومية عند 00:00 UTC. لم تنشر Reflection بعد طريقة طلب حدود أعلى، ولا توجد قائمة أسعار عامة للنسخة التجريبية.

وكلاء البرمجة

يتصل Mirror CLI بـ Beam باستخدام مفتاح API فقط. يعمل Pi وOpenCode وHermes من خلال إعدادات المزوّد المتوافقة مع OpenAI: عنوان URL الأساسي https://api.reflection.ai/openai/v1، والطراز Beam-501B-A23B، والمفتاح من REFLECTION_API_KEY. لا يدعم Mirror نظام Windows الأصلي.

curl -fsSL https://raw.githubusercontent.com/reflection-oss/mirror-beta/main/install.sh | bash

cd your-project
mirror        # uses Reflection and Beam-501B-A23B by default

تشغيل Beam بنفسك

عند إتاحة الأوزان، يمكن تشغيل Beam باستخدام محركات مفتوحة المصدر؛ وتقول Reflection إنها تعمل على توفير عمليات تكامل وشركاء للإطلاق. توقّع حاجة كبيرة إلى الذاكرة: يجب أن تكون جميع المعلمات البالغ عددها 501 مليارًا في ذاكرة GPU، رغم أن 23 مليارًا فقط تنشط لكل رمز. يعادل ذلك نحو 1 TB بصيغة BF16، و500 GB بصيغة FP8، و250 GB بدقة 4-bit، قبل احتساب ذاكرة KV المؤقتة.